Tôi có hai tập tin, hãy gọi cho họ 123.txtvà 789.txt. 123.txtdài 2,5 triệu dòng và dài 789.txt65 triệu dòng. Có cách nào để sử dụng grephoặc tương tự để giữ bất kỳ dòng 789.txtnào có chứa các dòng từ123.txt?
Sẽ có tối đa một bản sao trên mỗi dòng 789.txtvà văn bản trùng lặp sẽ ở đầu dòng. Tôi hoàn toàn bế tắc về điều này và không thể tìm thấy bất kỳ thông tin nào trên mạng, vì vậy tôi thực sự không có gì để bắt đầu. Nó sẽ chạy trên một máy chủ, vì vậy tôi không ngại mất một lúc (mà tôi biết nó sẽ)
123.txt:
hxxp://www.a.com hxxp://www.b.com hxxp://www.c.com789.txt:
hxxp://www.a.com/kgjdk-jgjg/ hxxp://www.b.com/gsjahk123/ hxxp://www.c.com/abc.txt hxxp://www.d.com/sahgsj/Sản phẩm chất lượng:
hxxp://www.a.com/kgjdk-jgjg/ hxxp://www.b.com/gsjahk123/ hxxp://www.c.com/abc.txt
123.txtkhông xuất hiện789.txtcũng như các dòng trong789.txtđó123.txt(chúng sẽ chỉ được in một lần, nhưng dù sao cũng được in).