Bạn đang dùng trình duyệt đã lỗi thời. Trình duyệt có thể không hiển thị đúng trang web này hoặc các trang web khác. Bạn nên nâng cấp hoặc dùng một trình duyệt khác.
chào các bác, sau một thời gian mò, e đang gặp một số vấn đề cần các bác tư vấn tiếp ạ
khi crawl nhiều nguồn thì làm sao lọc trùng lặp giữa các nguồn, ví dụ cùng một truyện nhưng link và title đôi khi không giống nhau
e thấy lượng data crawl về khá lớn khoảng trên 50gb thì có cần chọn lọc...
hầu như truyện đầu tiên đọc sẽ luôn cảm thấy hay nhất, với mình là Bàn Long, vì những truyện sau cảm giác sẽ bị đi theo 1 motip chung và cảm giác khá lê thê trong việc cày cấp, ví dụ PNTT. Có Tru Tiên cảm giác cốt truyện mới lạ kiếm hiệp + tiên hiệp, ko cày cuốc, nhưng dần hướng về yếu tố ngôn...
Chào các bác, em đang muốn làm một website truyện tranh, các bác cho em hỏi một số ý sau ạ:
1. Có tool crawl nào ngon, rẻ không, hay phải tự code (em code được nodejs)
2. Nguồn truyện ở đâu hợp lý và có vấn đề gì về bản quyền không