Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu

1
Thiết lập dữ liệu cho sự khác biệt
Thiết lập nào là chính xác cho sự khác biệt trong mô hình hồi quy khác biệt bằng cách sử dụng Yist=α+γs∗T+λdt+δ∗(T∗dt)+ϵistYist=α+γs∗T+λdt+δ∗(T∗dt)+ϵistY_{ist} = \alpha +\gamma_s*T + \lambda d_t + \delta*(T*d_t)+ \epsilon_{ist} Trong đó T là một hình nộm bằng 1 nếu quan sát từ nhóm điều trị và d là …

1
Kỳ vọng của Tổng số K mà không thay thế
Cho số, trong đó giá trị của mỗi số là khác nhau, được ký hiệu là và xác suất chọn từng số lần lượt là .nnnv1,v2,...,vnv1,v2,...,vnv_1, v_2, ..., v_np1,p2,...,pnp1,p2,...,pnp_1, p_2, ..., p_n Bây giờ nếu tôi chọn số dựa trên xác suất đã cho, trong đó , kỳ vọng về …




1
Các hệ số tương quan cho dữ liệu được đặt hàng: Kendall's Tau vs Polychoric vs Spearman's rho
Có vẻ như để quản lý với các phép đo được đặt hàng, các nhà nghiên cứu thường đối phó với Polychoric Correlation . (Ví dụ: để tạo ma trận trước khi thực hiện Phân tích nhân tố.) Tại sao vậy? Hệ số tương quan xếp hạng của Kendall Tau …



1
Rừng ngẫu nhiên có thể làm tốt hơn nhiều so với lỗi kiểm tra 2,8% trên MNIST không?
Tôi đã không tìm thấy bất kỳ tài liệu về việc áp dụng rừng ngẫu nhiên để MNIST, CIFAR, STL-10, vv để tôi nghĩ rằng tôi muốn thử chúng với hoán vị bất biến MNIST bản thân mình. Trong R , tôi đã thử: randomForest(train$x, factor(train$y), test$x, factor(test$y), ntree=500) Điều …

1
R: Anova và hồi quy tuyến tính
Tôi chưa quen với thống kê và tôi đang cố gắng tìm hiểu sự khác biệt giữa ANOVA và hồi quy tuyến tính. Tôi đang sử dụng R để khám phá điều này. Tôi đọc các bài viết khác nhau về lý do tại sao ANOVA và hồi quy khác …
9 r  regression  anova 






Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.