Thứ năm 08/10/2026 06:18
Hotline: 024.355.63.010
Email: banbientap.dnhn@gmail.com
Kinh tế số

Apple, Nvidia và Anthropic bị chỉ trích vì sử dụng trái phép dữ liệu YouTube để đào tạo AI

18/07/2024 12:14
Trước đó, CEO YouTube Neal Mohan khẳng định, việc các công ty sử dụng dữ liệu của YouTube để đào tạo các mô hình AI là vi phạm các điều khoản và dịch vụ của nền tảng này.
Ảnh minh họa
Ảnh minh họa.

Wall Street Journal dẫn kết quả mới đây của cuộc điều tra từ Proof News cho thấy, Apple, Nvidia và Anthropic đã sử dụng bộ dữ liệu tạo bởi công ty phi lợi nhuận có tên EleutherAI, chứa hơn 173.000 các bản ghi lại nội dung video YouTube của hơn 48.000 kênh mà không hề có sự xin phép chủ sở hữu hay nhà sáng tạo nội dung.

Mặc dù tập dữ liệu không chứa hình ảnh hay video, song các nội dung được lấy lại từ những nhà sáng tạo nội dung hàng đầu trên nền tảng như Marques Brownlee và MrBeast, cũng như các nhà xuất bản tin tức lớn như The New York Times, BBC và ABC News. Ngoài ra, còn có phụ đề từ các video thuộc về Engadget.

“Apple sử dụng dữ liệu từ một số công ty để huấn luyện cho AI của họ. Một trong số đó là các dữ liệu, bản ghi từ các video trên YouTube, bao gồm cả của tôi”, Brownlee, một người có sức ảnh hưởng trên YouTube đăng bài trên X.

Trước đó, CEO YouTube Neal Mohan khẳng định, việc các công ty sử dụng dữ liệu của YouTube để đào tạo các mô hình AI là vi phạm các điều khoản và dịch vụ của nền tảng này.

Apple, NVIDIA, Anthropic và EleutherAI đã không trả lời yêu cầu bình luận từ Engadget.

Người đứng đầu bộ phận AI và học máy tại Apple, ông John Giannandrea, cũng từng phát biểu rằng, "lượng lớn dữ liệu đào tạo thực sự được tạo ra bởi chính Apple" nhưng không đi vào chi tiết.

Gã khổng lồ công nghệ Thung lũng Silicon cũng được cho là đã ký thỏa thuận với Shutterstock và Photobucket nhằm cấp phép cho hình ảnh đào tạo dữ liệu AI, nhưng chưa xác nhận công khai mối quan hệ hợp tác. Trong khi Apple Intelligence cố gắng luôn cố gắng nhấn mạnh cách tiếp cận tập trung nhiều hơn vào quyền riêng tư thông qua bộ xử lý trên thiết bị và điện toán đám mây tùy chỉnh, thì dường như nguyên tắc cơ bản khi thu thập dữ liệu nền tảng cho mô hình AI của công ty không khác gì so với đa số đối thủ cạnh tranh.

Đầu tháng này, các nghệ sĩ và nhiếp ảnh gia đã chỉ trích Apple vì đã không tiết lộ nguồn dữ liệu đào tạo cho Apple Intelligence, công ty sở hữu công nghệ AI sắp ra mắt trên hàng triệu thiết bị Apple trong năm nay.

YouTube, kho lưu trữ video lớn nhất thế giới, là một kho vàng không chỉ có bản ghi mà còn cả âm thanh, video và hình ảnh, khiến nó trở thành một bộ dữ liệu hấp dẫn để đào tạo các mô hình AI. Đầu năm nay, Giám đốc công nghệ của OpenAI, Mira Murati, đã né tránh các câu hỏi từ The Wall Street Journal về việc liệu công ty có sử dụng video YouTube để đào tạo Sora, công cụ tạo video AI sắp ra mắt của OpenAI hay không. Murati cho biết vào thời điểm đó: “Tôi sẽ không đi sâu vào chi tiết về dữ liệu đã được sử dụng, nhưng đó là dữ liệu được cấp phép hoặc có sẵn công khai.

Giám đốc điều hành Alphabet Sundar Pichai cũng cho biết, các công ty sử dụng dữ liệu từ YouTube để đào tạo các mô hình AI của họ sẽ vi phạm điều khoản dịch vụ của nền tảng này.

Mới đây, Apple đã phải nộp phạt 210 triệu won (hơn 4 tỷ đồng) sau khi bị Ủy ban Truyền thông Hàn Quốc KCC cáo buộc thu thập dữ liệu vị trí mà không có sự đồng ý của người dùng. Hành vi của Apple vi phạm điều khoản liên quan dữ liệu vị trí và các chính sách khác của Hàn Quốc. Ngoài Apple, KCC cũng phạt Google, nhưng ở mức 3 triệu won (60 triệu đồng).

Thu Trà (t/h)

TAGS:

Tin bài khác
AI Việt Nam bước ra khu vực, bài toán lớn là hiệu quả

AI Việt Nam bước ra khu vực, bài toán lớn là hiệu quả

8 tổ chức, doanh nghiệp Việt Nam được vinh danh tại 10 hạng mục ASOCIO Digital & AI Awards 2026 cho thấy năng lực ứng dụng AI đang mở rộng từ pháp luật, giáo dục, y tế đến tài chính, sản xuất và an ninh mạng. Đáng chú ý, thước đo đang chuyển dần sang năng suất, chi phí và tác động thực tế.
Đúng mặt, đúng giọng vẫn có thể mất tiền vì Deepfake

Đúng mặt, đúng giọng vẫn có thể mất tiền vì Deepfake

AI đang khiến những cuộc gọi lừa đảo trở nên khó nhận diện hơn khi khuôn mặt, giọng nói và số điện thoại đều có thể bị giả mạo. Trong ngân hàng số, kiểm chứng độc lập trước khi chuyển tiền đang trở thành “lớp bảo vệ” quan trọng nhất của người dùng.
DeepSeek huy động gần 12 tỷ USD, hướng tới IPO đầu năm 2027

DeepSeek huy động gần 12 tỷ USD, hướng tới IPO đầu năm 2027

DeepSeek được cho là đang huy động ít nhất 80 tỷ nhân dân tệ, tương đương gần 12 tỷ USD, trước kế hoạch IPO dự kiến vào đầu năm 2027.
EU tính thuế mới với Big Tech Mỹ

EU tính thuế mới với Big Tech Mỹ

Brussels muốn tăng thu từ các tập đoàn lớn, trong đó có Apple, Meta và Google, nhưng tránh thiết kế sắc thuế nhắm riêng vào công nghệ để hạn chế nguy cơ Mỹ trả đũa.
Apple sắp ra mắt loạt sản phẩm mới, MacBook và iPad mini đáng chú ý

Apple sắp ra mắt loạt sản phẩm mới, MacBook và iPad mini đáng chú ý

Apple được cho là sẽ giới thiệu nhiều sản phẩm mới trong tháng 10, từ thiết bị nhà thông minh đến MacBook, iMac và iPad mini thế hệ mới.
Anthropic mở rộng thử nghiệm AI mạnh nhất cho chuyên gia an ninh mạng

Anthropic mở rộng thử nghiệm AI mạnh nhất cho chuyên gia an ninh mạng

Anthropic mở rộng Chương trình Xác thực An ninh mạng, cho phép các chuyên gia được thẩm định tiếp cận những mô hình AI tiên tiến hơn để phục vụ phòng thủ.
Mistral ra mắt mô hình AI mới, mở thêm lựa chọn cho doanh nghiệp

Mistral ra mắt mô hình AI mới, mở thêm lựa chọn cho doanh nghiệp

Mistral Large 4 được kỳ vọng giúp doanh nghiệp châu Âu tăng quyền kiểm soát dữ liệu, chi phí và công nghệ trong cuộc đua trí tuệ nhân tạo (AI).
Google bị điều tra tại Ba Lan, đối mặt nguy cơ phạt 10% doanh thu

Google bị điều tra tại Ba Lan, đối mặt nguy cơ phạt 10% doanh thu

Cơ quan chống độc quyền Ba Lan cáo buộc 4 công ty thuộc Google có dấu hiệu lạm dụng vị thế thống trị trong đàm phán phí sử dụng nội dung báo chí, với mức phạt tối đa có thể lên tới 10% doanh thu.
ISC Platform kết nối đổi mới sáng tạo với thị trường

ISC Platform kết nối đổi mới sáng tạo với thị trường

Nền tảng kết nối đổi mới sáng tạo ISC Platform được kỳ vọng trở thành hạ tầng số dùng chung, kết nối doanh nghiệp, viện trường, chuyên gia, startup, quỹ đầu tư và đối tác công nghệ, qua đó thu hẹp khoảng cách từ nghiên cứu, phát triển công nghệ đến thương mại hóa.
Google biến quyền năng AI thành cuộc đua thuê bao

Google biến quyền năng AI thành cuộc đua thuê bao

Cuộc cạnh tranh AI đang chuyển sang một mặt trận mới: không chỉ ai có mô hình mạnh hơn, mà ai có thể cung cấp nhiều quyền năng hơn trong mỗi cấp thuê bao. Với Google, AI ngày càng được gắn trực tiếp vào hệ sinh thái công cụ mà người dùng sử dụng mỗi ngày.
Google siết quyền truy cập Gemini: Người dùng miễn phí mất lựa chọn mô hình Pro

Google siết quyền truy cập Gemini: Người dùng miễn phí mất lựa chọn mô hình Pro

Google dự kiến giới hạn các mô hình Gemini theo cấp thuê bao từ ngày 9/10, trong khi bổ sung tính năng Deep Think cho người dùng AI Pro.
Màn hình gập iPhone Duo có thể thay lớp phủ, giá từ 19 USD

Màn hình gập iPhone Duo có thể thay lớp phủ, giá từ 19 USD

Apple cho biết lớp phủ nano texture trên màn hình gập iPhone Duo có thể được bóc và thay mới, với chi phí từ 19 USD đối với thiết bị có AppleCare+.
CEO OpenAI Sam Altman: Lợi ích từ AI lớn hơn rủi ro

CEO OpenAI Sam Altman: Lợi ích từ AI lớn hơn rủi ro

CEO OpenAI cho rằng xã hội có thể phải chấp nhận một phần rủi ro để đổi lấy lợi ích vượt trội từ AI, thay vì để công nghệ này nằm trong tay một số ít tổ chức.
Tây Ninh quy tụ 200 gian hàng công nghệ tại Ngày hội khoa học, công nghệ 2026

Tây Ninh quy tụ 200 gian hàng công nghệ tại Ngày hội khoa học, công nghệ 2026

Từ ngày 7-9/10/2026, Ngày hội Khoa học, Công nghệ, Đổi mới sáng tạo và Chuyển đổi số tỉnh Tây Ninh năm 2026 sẽ diễn ra tại Quảng trường Tô Quyền (Tây Ninh), với khoảng 200 gian hàng cùng chuỗi hoạt động triển lãm, trải nghiệm công nghệ, hội thảo, kết nối doanh nghiệp và đầu tư.
Cựu chuyên gia an toàn cảnh báo OpenAI đang tăng tốc nhanh hơn khả năng kiểm soát

Cựu chuyên gia an toàn cảnh báo OpenAI đang tăng tốc nhanh hơn khả năng kiểm soát

Sau 3 năm rưỡi tham gia xây dựng khuôn khổ chuẩn bị và giám sát báo cáo an toàn cho 12 đợt ra mắt mô hình tiên tiến, David Robinson cho rằng văn hóa ưu tiên tăng trưởng tại OpenAI đang đẩy năng lực AI tiến nhanh hơn nền tảng nghiên cứu và các lớp bảo vệ cần thiết.