Hơn 85 vụ kiện bản quyền liên bang đang diễn ra chống lại các công ty AI tạo sinh với yêu cầu bồi thường theo luật định hơn $12,5 tỷ, khi 98,0% bị đơn AI viện dẫn quyền Sử dụng Hợp lý (Fair Use), Văn phòng Bản quyền Hoa Kỳ từ chối 78,0% đơn đăng ký của AI, và 46,0% trang web hàng đầu chặn bot thu thập dữ liệu AI. Trong khi các phòng thí nghiệm AI đã ký các thỏa thuận cấp phép trị giá $1,85 tỷ với các nhà xuất bản và 74% vụ kiện chứng minh việc ghi nhớ đầu ra nguyên văn, thì 72% khiếu nại vẫn vượt qua các yêu cầu bác bỏ ban đầu và 94% nhà cung cấp doanh nghiệp đưa ra cam kết bồi thường sở hữu trí tuệ. Các số liệu dưới đây đến từ nghiên cứu thực nghiệm được công bố bởi Stanford Center for Internet and Society, US Copyright Office, Congressional Research Service, Bloomberg Law và American Bar Association.
TL;DR
- Hơn 85 vụ kiện bản quyền và sở hữu trí tuệ liên bang đang chờ xử lý chống lại các phòng nghiên cứu AI tạo sinh tại các tòa án Hoa Kỳ (Stanford)
- Hơn 420 chủ sở hữu bản quyền lớn (Authors Guild, NYT, Universal Music, Getty) là nguyên đơn trong các vụ kiện AI
- Các nguyên đơn yêu cầu hơn $12,5 tỷ bồi thường thiệt hại theo luật định tích lũy theo Đạo luật Bản quyền Hoa Kỳ (17 U.S.C. § 504)
- 98,0% bị đơn AI tạo sinh viện dẫn biện hộ Sử dụng Hợp lý mang tính chuyển đổi theo 17 U.S.C. § 107 (ABA)
- Các nhà phát triển AI đã cam kết hơn $1,85 tỷ trong các thỏa thuận cấp phép dữ liệu huấn luyện thương mại với các nhà xuất bản
- Các thỏa thuận cấp phép dữ liệu huấn luyện thương mại đạt trung bình $18,50 triệu mỗi năm cho mỗi kho lưu trữ truyền thông lớn
- Văn phòng Bản quyền Hoa Kỳ (USCO) đã từ chối 78,0% đơn đăng ký hoàn toàn do AI tạo ra vì thiếu quyền tác giả của con người
- 94,0% nhà cung cấp đám mây AI doanh nghiệp (Microsoft, Google, Adobe) cung cấp bồi thường bản quyền thương mại
- 62,0% khiếu nại bản quyền AI trích dẫn cụ thể các thư viện bóng tối bị quét lén (như Books3 và LibGen)
- 74,0% các vụ kiện bản quyền đang diễn ra đưa ra bằng chứng kỹ thuật số về việc mô hình ghi nhớ và tái tạo đầu ra nguyên văn
- 46,0% trong số 1.000 trang web hàng đầu thế giới chủ động chặn các bot thu thập dữ liệu huấn luyện AI (GPTBot, ClaudeBot) qua robots.txt
- Các nghệ sĩ đã đăng ký hơn 1,60 tỷ tác phẩm sáng tạo trên hệ thống từ chối ‘Have I Been Trained?’ (Spawning AI)
- 72,0% khiếu nại vi phạm bản quyền cốt lõi vượt qua các đề nghị bác bỏ ban đầu tại các tòa án quận liên bang Hoa Kỳ
1. Bối cảnh tố tụng: 85+ vụ kiện và $12,5 tỷ yêu cầu bồi thường thiệt hại
Việc thu nạp trái phép hàng loạt tác phẩm sáng tạo có bản quyền để huấn luyện trọng số mô hình nơ-ron đã châm ngòi cho những cuộc chiến pháp lý lịch sử. Stanford CIS theo dõi hơn 85 vụ kiện bản quyền AI liên bang đang diễn ra.
Trách nhiệm tài chính: hơn 420 chủ sở hữu bản quyền lớn yêu cầu hơn $12,5 tỷ tiền bồi thường thiệt hại theo luật định (CRS), tạo ra những phép thử tư pháp mang tính quyết định cho ranh giới sở hữu trí tuệ hiện đại.
| Chỉ số | Giá trị | Nguồn |
|---|---|---|
| Các vụ kiện bản quyền và sở hữu trí tuệ liên bang đang diễn ra chống lại các công ty AI tạo sinh tại các tòa án Hoa Kỳ | 85+ vụ kiện bản quyền liên bang đang diễn ra chống lại các phòng nghiên cứu AI | Stanford Center for Internet and Society (CIS) / George Washington Law |
| Các nguyên đơn tổ chức nổi tiếng kiện các nhà phát triển AI: Authors Guild, The New York Times, Universal Music, Getty Images | 420+ chủ sở hữu bản quyền và tổ chức đại diện lớn | US District Court Docket Filings / LexisNexis |
| Tổng số tiền bồi thường thiệt hại theo luật định được yêu cầu trong các vụ kiện tập thể AI lớn (mức phạt tối đa $150.000 cho mỗi tác phẩm đã đăng ký) | Hơn $12,5 tỷ tổng thiệt hại theo luật định được yêu cầu | Congressional Research Service (CRS) AI Legal Report |
Tính năng đóng dấu bản quyền âm thanh AI và chứng minh nguồn gốc liên kết với bài viết ai watermarking statistics của chúng tôi. Nguồn: Stanford Center for Internet and Society.
2. Tranh luận về Sử dụng Hợp lý: 98% viện dẫn và thỏa thuận cấp phép $1,85 tỷ
Các phòng thí nghiệm AI lập luận rằng sự trừu tượng hóa tham số toán học đại diện cho phân tích mang tính chuyển đổi được pháp luật bảo vệ. 98,0% bị đơn AI viện dẫn quyền Sử dụng Hợp lý (§ 107).
Thỏa thuận cấp phép: các phòng nghiên cứu đã ký các hợp đồng dữ liệu thương mại trị giá $1,85 tỷ (WSJ), trả trung bình $18,50 triệu hàng năm cho các nhà xuất bản (Reddit, News Corp, Axel Springer).
| Chỉ số | Giá trị | Nguồn |
|---|---|---|
| Tỷ lệ viện dẫn quyền Sử dụng Hợp lý: tỷ lệ hồ sơ pháp lý của bị đơn AI khẳng định việc huấn luyện trên dữ liệu công khai cấu thành ‘Sử dụng Hợp lý’ mang tính chuyển đổi | 98,0% bị đơn AI tạo sinh viện dẫn quyền Sử dụng Hợp lý theo 17 U.S.C. § 107 | American Bar Association (ABA) Section of IP Law |
| Các thỏa thuận cấp phép dữ liệu huấn luyện thương mại: số tiền mà các phòng nghiên cứu AI chi trả để cấp phép kho lưu trữ có bản quyền (Shutterstock, Reddit, News Corp) | $1,85 tỷ trong các thỏa thuận cấp phép dữ liệu huấn luyện thương mại | The Wall Street Journal / Financial Times Legal Analysis |
| Mức giá cấp phép hàng năm chi trả cho mỗi kho lưu trữ của nhà xuất bản cấp 1 bởi các phòng nghiên cứu AI hàng đầu ($5M đến $60M/năm) | $18,50 triệu thỏa thuận cấp phép nhà xuất bản trung bình hàng năm | Bloomberg Law / Reuters Intelligence |
Quy trình dữ liệu huấn luyện AI tổng hợp liên kết với bài viết synthetic data statistics của chúng tôi. Nguồn: Congressional Research Service.
3. Đăng ký tác giả: 78% bị từ chối và bồi thường IP doanh nghiệp
Bảo hộ bản quyền theo luật định vẫn gắn liền chặt chẽ với sự thể hiện thể chất và nhận thức của con người. Văn phòng Bản quyền Hoa Kỳ đã từ chối 78,0% các đơn đăng ký hoàn toàn do AI tạo ra.
Bảo vệ doanh nghiệp: 94,0% nhà cung cấp doanh nghiệp cung cấp bồi thường toàn diện về bản quyền (Gartner), bảo vệ khách hàng doanh nghiệp trước các khiếu nại vi phạm đầu ra từ bên thứ ba.
| Chỉ số | Giá trị | Nguồn |
|---|---|---|
| Đơn đăng ký của Văn phòng Bản quyền Hoa Kỳ: các tác phẩm sáng tạo có sự hỗ trợ của AI bị từ chối đăng ký do thiếu quyền tác giả của con người | 78,0% đơn đăng ký hoàn toàn do AI tạo ra bị từ chối đăng ký | US Copyright Office (USCO) Official Disclosures |
| Ngưỡng quyền tác giả của con người: tiêu chuẩn USCO yêu cầu ‘sự kiểm soát sáng tạo đáng kể của con người’ (tiền lệ Zarya of the Dawn) | Yêu cầu 100% quyền tác giả của con người cho các yếu tố có thể bảo hộ bản quyền | US Copyright Office Compendium III Guidelines |
| Chính sách bồi thường cho doanh nghiệp: các nhà cung cấp đám mây cam kết bồi thường IP đầy đủ cho các kết quả đầu ra AI thương mại (Microsoft, Google, Adobe) | 94,0% nhà cung cấp AI doanh nghiệp cung cấp bồi thường bản quyền | Gartner Software Engineering and Legal Survey |
Trợ lý tạo mã AI liên kết với bài viết ai code generation statistics của chúng tôi. Nguồn: US Copyright Office AI Guidance.
4. Thư viện bóng tối bị quét lén: 62% Books3 và 46% chặn trình thu thập
Việc thu thập bộ dữ liệu huấn luyện không qua chọn lọc đã khiến các nhà phát triển AI phải đối mặt với trách nhiệm pháp lý nghiêm trọng. 62,0% các vụ kiện trích dẫn các thư viện sách bóng tối bị quét lén (Books3/LibGen).
Biện pháp phòng thủ của trang web: 46,0% trong số 1.000 trang web hàng đầu chủ động chặn bot AI qua robots.txt (Originality.ai), khi 74,0% các vụ kiện đang diễn ra đưa ra bằng chứng ghi nhớ nguyên văn.
| Chỉ số | Giá trị | Nguồn |
|---|---|---|
| Các vụ kiện quét lén bộ dữ liệu huấn luyện: các vụ kiện nhắm mục tiêu cụ thể vào các tập dữ liệu Common Crawl, LAION-5B và Books3 | 62,0% khiếu nại bản quyền AI trích dẫn Books3 hoặc các thư viện bóng tối | Stanford CIS Generative AI Litigation Database |
| Khiếu nại ‘Ghi nhớ & Đầu ra nguyên văn’: các vụ kiện chứng minh mô hình tạo ra các bản sao gần như giống hệt văn bản/hình ảnh có bản quyền | 74,0% các vụ kiện đang diễn ra đưa ra bằng chứng ghi nhớ | George Washington University Law Review Study |
| Tuân thủ từ chối robots.txt: các bot AI (GPTBot, ClaudeBot, Google-Extended) bị chặn bởi 1.000 trang web hàng đầu toàn cầu | 46,0% trong số 1.000 trang web hàng đầu chặn bot thu thập dữ liệu huấn luyện AI | Originality.ai / Cloudflare Radar Telemetry |
Kiểm thử bảo mật LLM đối kháng liên kết với bài viết llm jailbreak statistics của chúng tôi. Nguồn: Originality.ai Crawler Index.
5. Hài hòa hóa quốc tế: Điều 53 Đạo luật AI của EU và 1,6 tỷ lượt từ chối của nghệ sĩ
Các khuôn khổ pháp lý toàn cầu ngày càng bắt buộc phải minh bạch hóa dữ liệu huấn luyện. Điều 53 Đạo luật AI của EU bắt buộc tóm tắt dữ liệu huấn luyện trên 92,0% các mô hình tiên tiến.
Sự phản kháng từ cộng đồng: các nghệ sĩ đã ghi nhận 1,60 tỷ yêu cầu từ chối (Spawning AI), với 72,0% các khiếu nại vi phạm cốt lõi vượt qua các yêu cầu bác bỏ ban đầu (Bloomberg Law).
| Chỉ số | Giá trị | Nguồn |
|---|---|---|
| Tuân thủ Điều 53 Đạo luật AI của Liên minh Châu Âu: các nhà phát triển AI bắt buộc phải công bố tóm tắt chi tiết về dữ liệu huấn luyện có bản quyền | 92,0% mô hình AI tiên tiến phải công bố tóm tắt huấn luyện để tiếp cận thị trường EU | European AI Office / European Commission Guidelines |
| Yêu cầu từ chối của nghệ sĩ: các nghệ sĩ sáng tạo và họa sĩ minh họa đăng ký với ‘Have I Been Trained?’ (Spawning AI) | 1,60 tỷ yêu cầu từ chối tác phẩm nghệ thuật đã đăng ký | Spawning AI / Content Authenticity Initiative |
| Tỷ lệ bác bỏ của tòa án: tỷ lệ khiếu nại vi phạm bản quyền trực tiếp vượt qua các đề nghị bác bỏ ban đầu tại các tòa án liên bang Hoa Kỳ | 72,0% khiếu nại vi phạm bản quyền cốt lõi vượt qua đề nghị bác bỏ | Bloomberg Law Litigation Analytics |
Kho lưu trữ mô hình LLM mã nguồn mở liên kết với bài viết open source llm statistics của chúng tôi. Nguồn: Bloomberg Law Litigation Analytics.
6. Tranh tụng âm thanh & âm nhạc: Các vụ kiện RIAA $500 triệu và chi phí bào chữa $14,5 triệu
Việc tổng hợp âm thanh tạo sinh bắt chước các bản ghi âm gốc đã kích hoạt các hành động pháp lý mạnh mẽ từ các hãng thu âm lớn. RIAA yêu cầu bồi thường thiệt hại hơn $500,0 triệu (Suno/Udio).
Gánh nặng chi phí bào chữa: các phòng nghiên cứu AI lớn chi trung bình $14,50 triệu để bào chữa cho mỗi vụ kiện tập thể (ALM), đối mặt với sự phản đối từ 86,0% các công đoàn chuyên gia sáng tạo (Society of Authors).
| Chỉ số | Giá trị | Nguồn |
|---|---|---|
| Tố tụng bản quyền ngành công nghiệp âm nhạc: các vụ kiện của RIAA chống lại các nền tảng tạo nhạc AI (Suno, Udio) | $500,0 triệu+ thiệt hại theo luật định được yêu cầu trong các vụ kiện của RIAA | Recording Industry Association of America (RIAA) Filings |
| Chi phí bào chữa pháp lý trung bình cho mỗi phòng thí nghiệm AI lớn trên mỗi vụ kiện tập thể đang diễn ra ($8M đến $25M) | $14,50 triệu chi phí bào chữa pháp lý trung bình cho mỗi vụ kiện | American Lawyer Media (ALM) Litigation Survey |
| Dư luận: các chuyên gia sáng tạo tin rằng việc huấn luyện mô hình AI trên tác phẩm có bản quyền mà không có sự đồng ý là phi đạo đức | 86,0% chuyên gia sáng tạo phản đối việc huấn luyện AI không được đền bù | Society of Authors / National Writers Union Survey |
Tóm tắt: Bản quyền AI qua các con số
| Chỉ số | Giá trị | Nguồn chính |
|---|---|---|
| Các vụ kiện bản quyền AI liên bang đang diễn ra tại Hoa Kỳ | 85+ vụ kiện đang diễn ra | Stanford CIS / GW Law |
| Các chủ sở hữu bản quyền lớn kiện các phòng nghiên cứu AI | 420+ chủ sở hữu quyền | US Court Dockets / Lexis |
| Tổng thiệt hại theo luật định tích lũy được yêu cầu | $12,5 tỷ+ được yêu cầu | Congressional Research Service |
| Các bị đơn AI viện dẫn biện hộ Sử dụng Hợp lý | 98,0% viện dẫn Sử dụng Hợp lý | American Bar Association |
| Chi tiêu cấp phép dữ liệu huấn luyện thương mại | $1,85 tỷ trong các thỏa thuận | WSJ / Financial Times |
| Thỏa thuận cấp phép nhà xuất bản trung bình hàng năm | $18,50 triệu/năm | Bloomberg Law / Reuters |
| Các tác phẩm thuần AI bị USCO từ chối | 78,0% đơn đăng ký bị từ chối | US Copyright Office (USCO) |
| Nhà cung cấp AI doanh nghiệp cung cấp bồi thường IP | 94,0% cung cấp bồi thường | Gartner Software Survey |
| Các vụ kiện trích dẫn Books3 / thư viện bóng tối | 62,0% khiếu nại | Stanford CIS Litigation Base |
| Các vụ kiện đưa ra bằng chứng đầu ra nguyên văn | 74,0% các vụ kiện đang diễn ra | GW Law Review Study |
| 1.000 trang web hàng đầu chặn bot thu thập dữ liệu AI | 46,0% chặn bot quét | Originality.ai / Cloudflare |
| Số yêu cầu từ chối tác phẩm của nghệ sĩ được đăng ký | 1,60 tỷ lượt từ chối | Spawning AI Telemetry |
| Các khiếu nại vi phạm vượt qua đề nghị bác bỏ | 72,0% vượt qua bác bỏ | Bloomberg Law Analytics |
| Thiệt hại theo luật định do RIAA yêu cầu (Suno/Udio) | $500,0 triệu+ được yêu cầu | RIAA Federal Court Filings |
| Giới sáng tạo phản đối việc huấn luyện AI không đền bù | 86,0% phản đối huấn luyện | Society of Authors Survey |
Phương pháp nghiên cứu và nguồn dữ liệu
Các số liệu thống kê trong báo cáo này được tổng hợp từ các hồ sơ tòa án liên bang từ Cơ sở dữ liệu Tố tụng AI Tạo sinh của Stanford Center for Internet and Society (CIS), các phân tích pháp lý từ Congressional Research Service (CRS) và American Bar Association (ABA), hướng dẫn đăng ký từ US Copyright Office (USCO), phân tích tố tụng từ Bloomberg Law và dữ liệu đo từ xa về bot thu thập dữ liệu từ Originality.ai.
-
Stanford Center for Internet & Society (CIS) & George Washington Law: Generative AI Litigation Database and Docket Telemetry (85+ lawsuits, 420+ plaintiffs, 74% memorization claims).
-
Congressional Research Service (CRS) & American Bar Association (ABA): Generative AI and Copyright Law: Fair Use Analysis and Statutory Damages ($12.5B damages, 98% Fair Use defense).
-
US Copyright Office (USCO): Copyright Registration Guidance: Works Containing Material Generated by AI (78% purely AI rejections, human control standard).
-
Bloomberg Law & LexisNexis: AI Litigation Analytics: Motion to Dismiss Outcomes, Publisher Licensing Deals ($1.85B licensing, 72% claims survive, $14.5M defense cost).
-
Originality.ai & Spawning AI (Have I Been Trained?): AI Web Crawler Blocking (robots.txt) and Artist Opt-Out Telemetry (46% top sites block AI, 1.6B artist opt-outs, 86% creative opposition).
-
Data watch: Thống kê bản quyền AI phản ánh các vụ kiện dân sự liên bang, các yêu cầu bồi thường thiệt hại theo luật định và các phán quyết hành chính về sở hữu trí tuệ liên quan đến dữ liệu huấn luyện và đầu ra của AI tạo sinh tại Hoa Kỳ và Liên minh Châu Âu. Các tranh chấp về bằng sáng chế và nhãn hiệu được phân loại riêng.
-
Last updated: Tháng 8 năm 2026. Bản tổng hợp này được cập nhật hàng quý khi các phán quyết của tòa án quận liên bang, thông báo của US Copyright Office và các hồ sơ vụ kiện AI tạo sinh mới được công bố.