Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu




4
Tính giá trị trung bình của biến số thứ tự
Tôi đã đọc ở một số nơi tính toán giá trị trung bình của biến thứ tự là không phù hợp. Tôi đang cố gắng để có được một trực giác về lý do tại sao nó có thể không phù hợp. Tôi nghĩ rằng đó là bởi vì, nói …


3
Khoảng tin cậy của RMSE
Tôi đã lấy một mẫu gồm điểm dữ liệu từ dân số. Mỗi điểm này có một giá trị thực (được biết từ sự thật mặt đất) và giá trị ước tính. Sau đó tôi tính sai số cho từng điểm được lấy mẫu và sau đó tính RMSE của …


4
Sự khác biệt giữa xét nghiệm ANOVA và Kruskal-Wallis
Tôi đang học R và đã thử nghiệm phân tích phương sai. Tôi đã chạy cả hai kruskal.test(depVar ~ indepVar, data=df) và anova(lm(depVar ~ indepVar, data=dF)) Có sự khác biệt thực tế giữa hai bài kiểm tra này? Sự hiểu biết của tôi là cả hai đều đánh giá giả …


2
Cách sử dụng các chức năng xác thực chéo của scikit-learn trên các trình phân loại đa nhãn
Tôi đang kiểm tra các trình phân loại khác nhau trên một tập dữ liệu có 5 lớp và mỗi trường hợp có thể thuộc về một hoặc nhiều lớp trong số đó, vì vậy, tôi đang sử dụng các trình phân loại đa nhãn của scikit-learn, cụ thể sklearn.multiclass.OneVsRestClassifier. …






Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.