Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu

2
Mô hình dự đoán bầu cử của Nate Silver
Nate Silver đã khá thành công trong việc dự đoán kết quả của các cuộc bầu cử ở Hoa Kỳ trong quá khứ, một điều được mô tả trong cuốn sách Tín hiệu và tiếng ồn của ông . Cuốn sách chứa một số mô tả về mô hình được …

3


1
Về giá trị AIC tiêu cực
Câu hỏi của tôi liên quan đến chủ đề Giá trị âm cho AIC trong Mô hình hỗn hợp chung . Tôi thường nhận được các giá trị AIC âm từ phần mềm tôi sử dụng. Tôi nhận thấy nó nhiều nhất khi tôi đang làm chuỗi thời gian. Nhưng …
8 aic 


2
Glmnet sử dụng sai lệch nào để so sánh các giá trị của ?
Một tiêu chí để chọn giá trị tối ưu của với mạng đàn hồi hoặc hồi quy bị phạt tương tự là kiểm tra sơ đồ sai lệch so với phạm vi của và chọn khi độ lệch được giảm thiểu (hoặc trong một lỗi tiêu chuẩn của tối thiểu).bước …
8 r  glmnet 


2
Một số lý do lặp đi lặp lại bình phương tối thiểu sẽ không hội tụ khi được sử dụng cho hồi quy logistic là gì?
Tôi đã sử dụng hàm glm.fit trong R để khớp các tham số với mô hình hồi quy logistic. Theo mặc định, glm.fit sử dụng các bình phương tối thiểu lặp lại để phù hợp với các tham số. Một số lý do thuật toán này sẽ không hội tụ, …


3
Làm thế nào để có được hàm lượng tử khi không biết hình thức phân tích của phân phối
Vấn đề xuất phát từ trang 377-379 của bài báo [0] này. Cho phân phối liên tục và cố định , hãy xem xét:FFFz∈Rz∈Rz\in\mathbb{R} Lz(t)=PF(|z−Z|≤t)Lz(t)=PF(|z−Z|≤t)L_z(t)=P_F(|z-Z|\leq t) và H(z)=L−1z(0.5)=medZ∼F|z−Z|H(z)=Lz−1(0.5)=medZ∼F|z−Z|H(z)=L^{-1}_z(0.5)=\underset{Z\sim F}{\mbox{med}}|z-Z| Trong đó là nghịch đảo liên tục đúng. Vì vậy, đối với một z cố định , đây là khoảng cách …



2
Tính toán thủ công giá trị p cho kiểm tra t: Làm thế nào để tránh các giá trị lớn hơn ?
Hai phương pháp tính giá trị p phải tương đương nhau: t.test(rats.drug,mu=1.2)$p.value 2*pt((mean(rats.drug)-1.2)*sqrt(n)/sd(rats.drug),df=n-1) Vấn đề với phương pháp thứ hai là có nguy cơ nhận được các giá trị lớn hơn (thực tế lên đến ):111222 2*pt((1.5-1.2)*sqrt(100)/.5,df=100-1) [1] 2 Điều này tất nhiên có thể được khắc phục bằng 2*pt((1.5-1.2)*sqrt(100)/.5,df=100-1,lower=F) …
8 r  t-test  p-value 


1
Xem lại giấy về bộ lọc hạt
Tôi đã tìm thấy trực tuyến một dự thảo của một đánh giá xuất sắc giấy bởi Zhe Chen mang tên "Bayesian Filtering: Từ Bộ lọc Kalman để lọc hạt, and Beyond". Theo Google Scholar, trích dẫn cho phiên bản đã xuất bản là "Thống kê 182 (1), 1-69, 2003" …

Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.