Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu

3
KNN: 1-láng giềng gần nhất
Câu hỏi của tôi là về phân loại hàng xóm gần nhất và là về một tuyên bố được đưa ra trong cuốn sách xuất sắc The Elements of Statistics Learning, của Hastie, Tibshirani và Friedman. Tuyên bố là (trang 465, phần 13.3): "Bởi vì nó chỉ sử dụng điểm …


2
Vector hóa của mất Entropy chéo
Tôi đang xử lý một vấn đề liên quan đến việc tìm độ dốc của hàm mất entropy chéo, ghi tham số trong đó:θθ\theta CE(θ)=−∑iyi∗log(y^i)CE(θ)=−∑iyi∗log(y^i)CE(\theta) = -\sum\nolimits_{i}{y_i*log({\hat{y}_{i}})} Trong đó, và là một đầu vào vector.y^i=softmax(θi)y^i=softmax(θi)\hat{y}_{i} = softmax(\theta_i)θiθi\theta_i Ngoài ra, là một vectơ nóng của lớp đúng và là dự đoán …

1
Hình thức đóng cửa cho
Chúng ta biết rằng nếu p∼Beta(α,β)p∼Beta(α,β)p \sim Beta(\alpha, \beta) , sau đó E[lnp]=ψ(α)−ψ(α+β)E[ln⁡p]=ψ(α)−ψ(α+β) \mathbb{E}[\ln p] = \psi(\alpha) - \psi(\alpha + \beta) nơi ψ(.)ψ(.)\psi(.) Là hàm Digamma. Có một hình thức dễ dàng cho E[ln(1−p)]E[ln⁡(1−p)] \mathbb{E}[\ln (1-p)] không?

1
Phân tích phân biệt tuyến tính cho
Tôi đang học 'Giới thiệu về học thống kê' của James, Witten, Hastie, Tibshirani. Trong trang 139, trong cuốn sách của họ, họ đã bắt đầu bằng cách giới thiệu Định lý của Bayes . πkhông phải là hằng số toán học, nhưng biểu thị xác suất trước. Không có …


1
Phạm vi của lambda trong hồi quy mạng đàn hồi
\def\l{|\!|} Cho hồi quy mạng đàn hồi minb12||y−Xb||2+αλ||b||22+(1−α)λ||b||1minb12||y−Xb||2+αλ||b||22+(1−α)λ||b||1\min_b \frac{1}{2}\l y - Xb \l^2 + \alpha\lambda \l b\l_2^2 + (1 - \alpha) \lambda \l b\l_1 làm thế nào có thể chọn một phạm vi thích hợp của λλ\lambda để xác thực chéo? Trong trường hợp α=1α=1\alpha=1 (hồi quy sườn) công thức …




1
Mô phỏng từ một phân phối bình thường hỗn hợp cắt ngắn
Tôi muốn mô phỏng một mẫu từ phân phối bình thường hỗn hợp sao cho p×N(μ1,σ21)+(1−p)×N(μ2,σ22)p×N(μ1,σ12)+(1−p)×N(μ2,σ22)p\times\mathcal{N}(\mu_1,\sigma_1^2) + (1-p)\times\mathcal{N}(\mu_2,\sigma_2^2) được giới hạn trong khoảng thay vì . Điều này có nghĩa là tôi muốn mô phỏng một hỗn hợp cắt ngắn của các bản phân phối bình thường.R[0,1][0,1][0,1]RR\mathbb{R} Tôi biết rằng …

1
Ước tính các hiệu ứng ngẫu nhiên trong mô hình nhị thức (lme4)
Tôi đang mô phỏng các thử nghiệm Bernoulli với một giữa các nhóm và sau đó tôi khớp với mô hình tương ứng với các gói:logitθ∼N(logitθ0,12)logitθ∼N(logitθ0,12)\text{logit}\, \theta \sim {\cal N}(\text{logit}\, \theta_0, 1^2)lme4 library(lme4) library(data.table) I <- 30 # number of groups J <- 10 # number of Bernoulli trials within …



2
Giải thích âm mưu ACF và PACF
Dữ liệu thô của tôi bao gồm chuỗi thời gian 60 ngày với xu hướng giảm. Dữ liệu là hàng tuần nên tần số được đặt thành 7. Tôi đã tính toán sự khác biệt của dữ liệu trông như thế này Khi tôi chạy các âm mưu ACF và …

Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.