Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu







1
PCA là CCA như ICA là gì?
PCA tìm kiếm các yếu tố trong dữ liệu tối đa hóa phương sai được giải thích. Theo phân tích tương quan Canonical (CCA), theo như tôi hiểu, giống như một PCA nhưng tìm kiếm một yếu tố tối đa hóa hiệp phương sai giữa hai bộ dữ liệu. Vì …

2
Phần dư trong GLM ở đâu?
Bây giờ tôi mới chuyển sang GLM sau các mô hình tiêu chuẩn. Trong mô hình tiêu chuẩn, y = Xb + epsilon và epsilon được coi là phân phối bình thường. Điều đó có nghĩa là chúng ta có thể viết y - Xb = epsilon và sau đó …


2
Mối quan hệ của hàm mục tiêu lấy mẫu âm (NS) với hàm mục tiêu ban đầu trong word2vec là gì?
Tôi đã đọc mô hình word2vec tiêu chuẩn / nổi tiếng và theo ghi chú của standord cho cs224n , hàm mục tiêu thay đổi từ: Joriginal=−∑j=0,j≠m2mu⊤c−m+jvc+2mlog(∑k=1|V|exp(u⊤kvc))Joriginal=−∑j=0,j≠m2muc−m+j⊤vc+2mlog(∑k=1|V|exp(uk⊤vc))J_{original} = -\sum^{2m}_{j=0,j\neq m} u^\top_{c-m+j} v_c + 2m log \left( \sum^{|V|}_{k=1} exp(u^{\top}_k v_c) \right) đến: JNS1=−logσ(u⊤c−m+jvc)−∑k=1Klogσ(−u⊤kvc)JNS1=−logσ(uc−m+j⊤vc)−∑k=1Klogσ(−uk⊤vc)J_{NS1} = -log \sigma( u^\top_{c-m+j} v_c ) - \sum^{K}_{k=1} …



2
Quá trình Gaussian và Tương quan
Tôi đã tự hỏi tại sao mọi người sử dụng các quy trình Gaussian (GP) để mô hình hóa một hàm chưa biết (đôi khi xác định). Ví dụ, hãy xem xét một hàm chưa biết . Chúng tôi có ba quan sát độc lập từ chức năng này: y=f(x)y=f(x)y=f(x)(x1,y1);(x2,y2);(x3,y3)(x1,y1);(x2,y2);(x3,y3)\big(x_1,y_1); …



Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.