Thống kê và dữ liệu lớn

Q & A cho những người quan tâm đến thống kê, học máy, phân tích dữ liệu, khai thác dữ liệu và trực quan hóa dữ liệu


1
Một bài báo đề cập đến một mô phỏng của Monte Monte Carlo để xác định số lượng các thành phần chính làm thế nào nó hoạt động?
Tôi đang thực hiện phân tích Matlab trên dữ liệu MRI nơi tôi đã thực hiện PCA trên ma trận có kích thước 10304x236 trong đó 10304 là số lượng voxels (nghĩ về chúng như pixel) và 236 là số lượng thời gian. PCA cung cấp cho tôi 236 Eigenvalues …



1
Làm thế nào để vẽ biểu đồ được trang bị và biểu đồ phân phối gamma thực tế trong một ô?
Tải gói cần thiết. library(ggplot2) library(MASS) Tạo 10.000 số được trang bị để phân phối gamma. x <- round(rgamma(100000,shape = 2,rate = 0.2),1) x <- x[which(x>0)] Vẽ hàm mật độ xác suất, giả sử chúng ta không biết phân phối x nào phù hợp. t1 <- as.data.frame(table(x)) names(t1) <- c("x","y") …




1
Sử dụng trung bình để tính phương sai
Tôi có một biến ngẫu nhiên 1-D cực kỳ sai lệch. Để bình thường hóa phân phối này, tôi muốn sử dụng trung bình hơn là trung bình. Câu hỏi của tôi là: tôi có thể tính toán phương sai của phân phối bằng cách sử dụng trung bình trong …
10 variance  mean  median 

1
Bay Variational kết hợp với Monte Carlo
Tôi đang đọc Bayes đa dạng và khi tôi hiểu nó, có ý tưởng rằng bạn xấp xỉ (trong đó là các biến tiềm ẩn của mô hình của bạn và dữ liệu được quan sát) với một hàm , đưa ra giả định rằng nhân tố là trong đó …



1
Là giải thích về độ thưa thớt chính xác?
Theo tài liệu của removeSparseTermschức năng từ tmgói, đây là những gì thưa thớt đòi hỏi: A term-document matrix where those terms from x are removed which have at least a sparse percentage of empty (i.e., terms occurring 0 times in a document) elements. I.e., the resulting matrix contains only …

6
Ký hiệu được đọc như thế nào?
Ký hiệu được đọc như thế nào? Là sau một phân phối bình thường? Hoặc là một phân phối bình thường? Hoặc có lẽ là xấp xỉ bình thường ..X X XX~ N( Μ , σ2)X∼N(μ,σ2)X\sim N(\mu,\sigma^2)XXX XXX XXX Điều gì xảy ra nếu có một số biến theo sau …

3
Xác định các tính năng được lọc sau khi chọn tính năng với scikit learn
Đây là Mã của tôi cho phương pháp chọn tính năng trong Python: from sklearn.svm import LinearSVC from sklearn.datasets import load_iris iris = load_iris() X, y = iris.data, iris.target X.shape (150, 4) X_new = LinearSVC(C=0.01, penalty="l1", dual=False).fit_transform(X, y) X_new.shape (150, 3) Nhưng sau khi nhận được X mới (biến phụ …

Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.