Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu


4
Lựa chọn nào cho kết quả khi Kruskal-Wallis và Mann-Whitney dường như trả lại kết quả trái ngược nhau?
Tôi có các nhóm này trong đó các giá trị là phản hồi cho mục Likert 10 điểm: g1 <- c(10,9,10,9,10,8,9) g2 <- c(4,9,4,9,8,8,8) g3 <- c(9,7,9,4,8,9,10) Do đó, tôi đã sử dụng Kruskal-Wallis để xác định bất kỳ sự khác biệt nào giữa các phản hồi trong các nhóm …






1
Giúp hiểu kNN cho dữ liệu đa chiều
Tôi hiểu tiền đề của thuật toán kNN cho dữ liệu không gian. Và tôi biết rằng tôi có thể mở rộng thuật toán đó để sử dụng trên bất kỳ biến dữ liệu liên tục nào (hoặc dữ liệu danh nghĩa với Hamming Khoảng cách). Tuy nhiên, chiến lược …


2
Pooling so với sải chân cho downsampling
Pooling và sải chân cả hai có thể được sử dụng để lấy mẫu hình ảnh. Giả sử chúng ta có một hình ảnh của 4 x 4, như bên dưới và bộ lọc 2x2. Vậy thì làm thế nào để chúng ta quyết định có nên sử dụng (gộp …

1
mlr so với caret
Tôi đã sử dụng mlr một chút để tìm hiểu về học máy, nhưng gần đây đã phát hiện ra về caret. Theo cách hiểu của tôi thì cả hai đều là các gói cho các gói ML khác nhau, nhưng có cách tiếp cận hơi khác nhau. Mặc dù …


3
Giải thích khoảng tin cậy 95%
Ban đầu tôi đã đăng câu dưới đây như một câu trả lời một phần cho câu hỏi hỏi tại sao khoảng tin cậy 95% không ngụ ý rằng có 95% khả năng khoảng đó chứa giá trị trung bình thực (xem: Tại sao Khoảng tin cậy (CI) 95% không …



Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.