Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu


4
Tại sao đặt trọng số lên 1 trong phân tích nhân tố xác nhận?
Tôi viết câu hỏi này với tham chiếu đến một ví dụ trên p138-142 của tài liệu sau: ftp://ftp.software.ibm.com/software/analytics/spss/documentation/amos/20.0/en/Manuals/IBM_SPSS_Amos_User_Guide.p . Dưới đây là số liệu minh họa và một bảng: Tôi hiểu rằng biến tiềm ẩn không có số liệu tự nhiên và việc đặt hệ số tải thành 1 …


3
Tại sao svm không tốt như cây quyết định trên cùng một dữ liệu?
Tôi chưa quen với học máy và cố gắng sử dụng scikit-learn (sklearn) để giải quyết vấn đề phân loại. Cả Quyết định và SVM đều có thể đào tạo một trình phân loại cho vấn đề này. Tôi sử dụng sklearn.ensemble.RandomForestClassifiervà sklearn.svm.SVCđể phù hợp với cùng một dữ liệu …










2
Tính toán khả năng khi rất lớn, vậy khả năng trở nên rất nhỏ?
Tôi đang cố gắng tính toán phân phối sau này: ( Q | - ) = Πni = 1pyTôiTôi( 1 - pTôi)1 - yTôiΣtất cảθ , pTôi| θΠni = 1pyTôiTôi( 1 - pTôi)1 - yTôi(θ|-)= =ΠTôi= =1npTôiyTôi(1-pTôi)1-yTôiΣtất cảθ,pTôi|θΠTôi= =1npTôiyTôi(1-pTôi)1-yTôi (\theta|-)=\frac{\prod_{i=1}^{n}p_i^{y_i}(1-p_i)^{1-y_i}}{\sum_{\text{all}\,\theta,p_i|\theta}\prod_{i=1}^{n}p_i^{y_i}(1-p_i)^{1-y_i}} Vấn đề là tử số, là sản phẩm của một …


Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.