Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu




2
Hàm khả năng của dữ liệu bị cắt
Tôi gặp một chút khó khăn trong việc hiểu khái niệm và dẫn xuất về khả năng dữ liệu bị cắt ngắn. Ví dụ: nếu tôi muốn tìm hàm khả năng dựa trên mẫu từ phân phối, nhưng khi lấy mẫu từ phân phối, tôi quan sát các giá trị …

2
Mô hình hệ số ma trận cho các hệ thống đề xuất làm thế nào để xác định số lượng các tính năng tiềm ẩn?
Tôi đang cố gắng thiết kế một kỹ thuật nhân tố ma trận cho một mục người dùng đơn giản, hệ thống đề xuất xếp hạng. Tôi có 2 câu hỏi về điều này. Trước tiên, trong một triển khai đơn giản mà tôi thấy về kỹ thuật nhân tố …





2
Khi n tăng giá trị t tăng trong kiểm tra giả thuyết, nhưng bảng t thì ngược lại. Tại sao?
Công thức cho trong một bài kiểm tra giả thuyết được đưa ra bởi: tttt=X¯−μσ^/n−−√.t=X¯−μσ^/n. t=\frac{\bar{X}-\mu}{\hat \sigma/\sqrt{n}}. Khi tăng, giá trị tăng theo công thức trên. Nhưng tại sao giá trị quan trọng lại giảm trong -table khi (là hàm của ) tăng?nnntttttttttdfdf\text{df}nnn

2
Kết hợp giá trị p từ các thử nghiệm thống kê khác nhau được áp dụng trên cùng một dữ liệu
Mặc dù tiêu đề của câu hỏi có vẻ tầm thường, tôi muốn giải thích rằng nó không tầm thường theo nghĩa nó khác với câu hỏi về việc áp dụng cùng một bài kiểm tra thống kê trong các bộ dữ liệu tương tự để kiểm tra giả thuyết …

3
Trình diễn sai lệch lượng tử mẫu
Trong khi thực hiện một số mô phỏng, tôi nhận ra rằng lượng tử mẫu là một ước lượng sai lệch của lượng tử thực. Và, theo mô phỏng của tôi, một khả năng rất thiên vị. Tôi đã rất ngạc nhiên với kết quả đó vì CDF theo kinh …

2
Ví dụ cho một lớp SVM trong R
Tôi đang cố gắng thực hiện SVM một lớp trong R. Tôi đã cố gắng sử dụng gói kernlab e1071 / ksvm. Nhưng tôi không chắc là tôi đang làm đúng hay không. Có ví dụ làm việc nào cho SVM một lớp trong R không? Cũng thế, Tôi đang …
8 r  svm 


1
Hiển thị dữ liệu theo chiều dọc với kết quả nhị phân
Đối với dữ liệu theo chiều dọc với kết quả bằng số, tôi có thể sử dụng các lô spaghetti để trực quan hóa dữ liệu. Ví dụ: một cái gì đó như thế này (lấy từ trang thống kê UCLA): tolerance<-read.table("http://www.ats.ucla.edu/stat/r/faq/tolpp.csv",sep=",", header=T) head(tolerance, n=10) interaction.plot(tolerance$time, tolerance$id, tolerance$tolerance, xlab="time", ylab="Tolerance", …

Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.