Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu

2
Giải thích entropy cho phân phối liên tục?
"Entropy" đại khái nắm bắt mức độ "thông tin" trong phân phối xác suất. Đối với các phân phối rời rạc, có một cách giải thích chính xác hơn nhiều: entropy của một biến ngẫu nhiên rời rạc là giới hạn thấp hơn trên số bit dự kiến ​​cần thiết …




2
Cốt truyện QQ và
Nếu qqplot của tôi là tuyến tính nhưng độ dốc không giống với đường 45 độ, thì điều này gợi ý gì? Tôi đang cố gắng kiểm tra sự phù hợp của phân phối laplace với dữ liệu mẫu của mình, vì vậy tôi đã tạo ngẫu nhiên các laplace …
7 r  qq-plot 


1
Phân phối nhị thức trong đó số lượng thí nghiệm được phân phối nhị thức
Trong thiết lập của tôi, Có thử nghiệm.mmm Mỗi thử nghiệm có một xác suất được chọn.qqq N≤mN≤mN \leq m là số lượng thử nghiệm được chọn →N∼Bin(q,m)→N∼Bin(q,m) \rightarrow N \sim \text{Bin}(q, m) Đối với mỗi thử nghiệm được chọn, xác suất thành công làNNNppp K≤NK≤NK\leq N là số lượng …



1
Hiển thị và là độc lập: tìm kiếm giải pháp cho vấn đề sách giáo khoa này
Trong phần Giới thiệu về Mô hình tuyến tính tổng quát của Dobson và Barnett, bài tập 1.4b & c như sau: Đặt là các biến ngẫu nhiên độc lập, mỗi biến có phân phối . Đặt và . ...Y1,...,YnY1,...,YnY_1,...,Y_nN(μ,σ2)N(μ,σ2)N(\mu,\sigma^2)Y¯¯¯¯=1n∑ni=1YiY¯=1n∑i=1nYi\overline{Y}=\frac{1}{n}\sum_{i=1}^{n}Y_iS2=1n−1∑ni=1(Yi−Y¯¯¯¯)2S2=1n−1∑i=1n(Yi−Y¯)2S^2=\frac{1}{n-1}\sum_{i=1}^{n}(Y_i-\overline{Y})^2 b. Chứng tỏ rằngS2=1n−1[∑ni=1(Yi−μ)2−n(Y¯¯¯¯−μ)2]S2=1n−1[∑i=1n(Yi−μ)2−n(Y¯−μ)2]S^2 = \frac{1}{n-1}[\sum_{i=1}^{n}(Y_i-\mu)^2-n(\overline{Y}-\mu)^2] c. Từ (b) theo …


3
Nếu bình phương Lỗi bình phương = Phương sai + Xu hướng ^ 2. Vậy thì làm thế nào để lỗi bình phương trung bình có thể thấp hơn phương sai
Tôi đã đọc phần Giới thiệu về Học thống kê. Ở đây nó được hiển thị rằng: - Trong một ví dụ sau, MSE đào tạo và thử nghiệm được vẽ. Tôi muốn biết nếu cả hai độ lệch ^ 2 và phương sai đều là các đại lượng dương …

2
Xác suất mà một học sinh đạt điểm cao hơn một bài kiểm tra khác với các câu hỏi được chọn ngẫu nhiên là gì?
Giả sử có một bộ gồm câu hỏi và có học sinh và .SSS100100100222aaabbb Đặt là xác suất để câu trả lời đúng cho câu hỏi và giống với .PaiPaiP_{ai}aaaiiiPbiPbiP_{bi}bbb Tất cả và được cung cấp cho .PaiPaiP_{ai}PbiPbiP_{bi}i=1...100i=1...100i = 1...100 Giả sử một kỳ thi được làm bằng cách lấy …

2
Tại sao mã hóa điều trị dẫn đến một mối tương quan giữa độ dốc ngẫu nhiên và đánh chặn?
Xem xét một thiết kế giai thừa trong chủ đề và bên trong vật phẩm trong đó biến điều trị thử nghiệm có hai cấp độ (điều kiện). Hãy m1là mô hình tối đa và mô hình m2không tương quan ngẫu nhiên. m1: y ~ condition + (condition|subject) + (condition|item) …


Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.