Câu hỏi được gắn thẻ «data-mining»

Khai thác dữ liệu sử dụng các phương thức từ trí tuệ nhân tạo trong bối cảnh cơ sở dữ liệu để khám phá các mẫu chưa biết trước đó. Như vậy, các phương pháp thường không được giám sát. Nó liên quan chặt chẽ nhưng không giống với học máy. Nhiệm vụ chính của khai thác dữ liệu là phân tích cụm, phát hiện ngoại lệ và khai thác các quy tắc kết hợp.


3
Liên quan đến việc sử dụng mô hình bigram (N-gram) để xây dựng vector tính năng cho tài liệu văn bản
Một cách tiếp cận truyền thống về xây dựng tính năng để khai thác văn bản là cách tiếp cận theo từ và có thể được tăng cường bằng cách sử dụng tf-idf để thiết lập vectơ đặc trưng mô tả tài liệu văn bản đã cho. Hiện tại, tôi …







1
R hồi quy tuyến tính biến phân loại Biến ẩn giá trị
Đây chỉ là một ví dụ mà tôi đã bắt gặp nhiều lần, vì vậy tôi không có bất kỳ dữ liệu mẫu nào. Chạy mô hình hồi quy tuyến tính trong R: a.lm = lm(Y ~ x1 + x2) x1là một biến liên tục. x2là phân loại và có …
10 r  regression  categorical-data  regression-coefficients  categorical-encoding  machine-learning  random-forest  anova  spss  r  self-study  bootstrap  monte-carlo  r  multiple-regression  partitioning  neural-networks  normalization  machine-learning  svm  kernel-trick  self-study  survival  cox-model  repeated-measures  survey  likert  correlation  variance  sampling  meta-analysis  anova  independence  sample  assumptions  bayesian  covariance  r  regression  time-series  mathematical-statistics  graphical-model  machine-learning  linear-model  kernel-trick  linear-algebra  self-study  moments  function  correlation  spss  probability  confidence-interval  sampling  mean  population  r  generalized-linear-model  prediction  offset  data-visualization  clustering  sas  cart  binning  sas  logistic  causality  regression  self-study  standard-error  r  distributions  r  regression  time-series  multiple-regression  python  chi-squared  independence  sample  clustering  data-mining  rapidminer  probability  stochastic-processes  clustering  binary-data  dimensionality-reduction  svd  correspondence-analysis  data-visualization  excel  c#  hypothesis-testing  econometrics  survey  rating  composite  regression  least-squares  mcmc  markov-process  kullback-leibler  convergence  predictive-models  r  regression  anova  confidence-interval  survival  cox-model  hazard  normal-distribution  autoregressive  mixed-model  r  mixed-model  sas  hypothesis-testing  mediation  interaction 







Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.