Câu hỏi được gắn thẻ «text-mining»

Đề cập đến một tập hợp khai thác dữ liệu liên quan đến việc trích xuất thông tin từ dữ liệu dưới dạng văn bản bằng cách nhận dạng các mẫu. Mục tiêu của khai thác văn bản thường là phân loại một tài liệu nhất định thành một trong một số loại theo cách tự động và để cải thiện hiệu suất này một cách linh hoạt, biến nó thành một ví dụ về học máy. Một ví dụ về loại khai thác văn bản này là các bộ lọc thư rác được sử dụng cho email.

2
Quy mô dữ liệu quy mô và đạo đức
Vài điều trong cuộc sống mang lại cho tôi niềm vui như cạo dữ liệu có cấu trúc và không cấu trúc từ Internet và sử dụng nó trong các mô hình của tôi. Chẳng hạn, Bộ công cụ khoa học dữ liệu (hoặc RDSTKdành cho lập trình viên R) …



2
Thuật toán kết hợp ưu tiên
Có dự án phụ này tôi đang làm việc ở nơi tôi cần cấu trúc một giải pháp cho vấn đề sau. Tôi có hai nhóm người (khách hàng). Nhóm Adự định mua và nhóm Bdự định bán một sản phẩm xác định X. Sản phẩm có một loạt các …





4
Sử dụng phân cụm trong xử lý văn bản
Xin chào, đây là câu hỏi đầu tiên của tôi trong ngăn xếp Khoa học dữ liệu. Tôi muốn tạo một thuật toán để phân loại văn bản. Giả sử tôi có một bộ lớn các văn bản và bài viết. Hãy nói khoảng 5000 văn bản đơn giản. Trước …


3
Ngôn ngữ tốt nhất cho máy tính khoa học [đóng]
Đã đóng cửa . Câu hỏi này cần được tập trung hơn . Nó hiện không chấp nhận câu trả lời. Bạn muốn cải thiện câu hỏi này? Cập nhật câu hỏi để nó chỉ tập trung vào một vấn đề bằng cách chỉnh sửa bài đăng này . Đóng …
10 efficiency  statistics  tools  knowledge-base  machine-learning  neural-network  deep-learning  optimization  hyperparameter  machine-learning  time-series  categorical-data  logistic-regression  python  visualization  bigdata  efficiency  classification  binary  svm  random-forest  logistic-regression  data-mining  sql  experiments  bigdata  efficiency  performance  scalability  distributed  bigdata  nlp  statistics  education  knowledge-base  definitions  machine-learning  recommender-system  evaluation  efficiency  algorithms  parameter  efficiency  scalability  sql  statistics  visualization  knowledge-base  education  machine-learning  r  python  r  text-mining  sentiment-analysis  machine-learning  machine-learning  python  neural-network  statistics  reference-request  machine-learning  data-mining  python  classification  data-mining  bigdata  usecase  apache-hadoop  map-reduce  aws  education  feature-selection  machine-learning  machine-learning  sports  data-formats  hierarchical-data-format  bigdata  apache-hadoop  bigdata  apache-hadoop  python  visualization  knowledge-base  classification  confusion-matrix  accuracy  bigdata  apache-hadoop  bigdata  efficiency  apache-hadoop  distributed  machine-translation  nlp  metadata  data-cleaning  text-mining  python  pandas  machine-learning  python  pandas  scikit-learn  bigdata  machine-learning  databases  clustering  data-mining  recommender-system 





Khi sử dụng trang web của chúng tôi, bạn xác nhận rằng bạn đã đọc và hiểu Chính sách cookieChính sách bảo mật của chúng tôi.
Licensed under cc by-sa 3.0 with attribution required.