Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu



2
Tìm kiếm 'Khuỷu tay' trong dữ liệu
Subitization là phép liệt kê nhanh, chính xác của màn hình số lượng thấp, được phân biệt với việc đếm bằng một phi tuyến sắc nét trong biểu đồ thời gian đáp ứng. Dưới đây là một âm mưu đại diện, từ Watson, DG, Maylor, EA, & Bruce, LAM (2007). …



1
Tại sao nên sử dụng bayesglm?
Câu hỏi tổng thể của tôi là: tại sao sử dụng bayesglmthay vì các phương pháp phân loại khác? Ghi chú: Tôi chỉ quan tâm đến dự đoán. Tôi có một lượng dữ liệu kha khá (~ 100.000 obs). Tôi cảm thấy như cỡ mẫu đủ lớn, các tham số …







3
Làm cách nào để thực hiện phân loại Rừng ngẫu nhiên không giám sát bằng mã của Breiman?
Tôi đang làm việc với mã rừng ngẫu nhiên của Breiman ( http: //stat-www.ber siêu.edu/users/oustiman/RandomForests/cc_manual.htmlm#c2 ) để phân loại dữ liệu vệ tinh (học có giám sát). Tôi đang sử dụng tập dữ liệu huấn luyện và kiểm tra có cỡ mẫu 2000 và kích thước thay đổi 10. Dữ …



Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.