Thứ năm 01/10/2026 17:31
Hotline: 024.355.63.010
Email: banbientap.dnhn@gmail.com
Kinh tế số

Ai đang dạy cho trí tuệ nhân tạo?

12/10/2020 00:00
Cụm từ AI (trí tuệ thông minh nhân tạo) thường tạo ở người nghe một hình ảnh về một hệ thống phức tạp, tân kỳ, hiện đại và hào nhoáng. Thế nên có ai bảo tù nhân ở Phần Lan hay công nhân giá rẻ ở Trung Quốc đang dạy cho AI học, ắt ta sẽ nghĩ đây chỉ l

Ảnh minh họa. Nguồn: Internet

Vainu, một công ty khởi nghiệp ở Phần Lan, đang xây dựng một cơ sở dữ liệu khổng lồ về tất cả mọi doanh nghiệp trên thế giới với tham vọng cung cấp dịch vụ giúp kết nối doanh nghiệp với đúng đối tác họ cần. Để cơ sở dữ liệu được cập nhật và có các thông tin riêng độc đáo, Vainu tổ chức để thuê người đọc hàng trăm ngàn bài viết về doanh nghiệp thu thập từ Internet và dán nhãn để miêu tả chúng, ví dụ bài này là về hãng Apple sản xuất iPhone, bài kia là về doanh nghiệp xuất khẩu táo.

Với các bài bằng tiếng Anh, Vainu sử dụng chợ nhân công giá rẻ trên mạng gọi là “Amazon Mechanical Turk” - một nơi doanh nghiệp thường dùng để thuê người làm những phần việc mang tính lặp đi lặp lại, loại công việc có thể làm từ xa. Nhưng với tiếng Phần Lan thì các chợ này bó tay, không tìm ra người chịu làm việc giá rẻ. Thế là Vainu bèn hợp tác với cơ quan quản lý tù nhân của Phần Lan, danh nghĩa là giúp tù nhân học nghề nhưng cũng là cách tận dụng lao động rẻ bằng cách trang bị máy tính cho hai nhà tù để tù nhân ngồi dán nhãn các bài báo cho họ. Sau khi có dữ liệu đã dán nhãn, Vainu mới dạy cho máy học các thuật toán phân tích dữ liệu.

Máy tính làm các phép tính rất nhanh, nhưng thiếu khả năng nhận biết nên thua ngay cả một em bé trong khía cạnh này. Các em bé nhìn một con béc-giê và một con chihuahua thì dù chúng khác nhau một trời một vực các em cũng biết chúng đều là chó. Máy tính thì phải dạy và không phải chỉ dạy từng hình, bằng không thì dù đã thấy hình chó mực nhưng sau đó thấy một con chó đốm nó sẽ bảo đó không phải là chó.

Trí tuệ thông minh nhân tạo cần một lượng dữ liệu khổng lồ để máy học, ví dụ đưa các phim chụp cộng hưởng từ (MRI) vào máy kèm theo là chẩn đoán đúng của các bác sĩ. Từ hàng ngàn, hàng chục ngàn phim MRI có chẩn đoán của con người, máy sẽ học để sau đó nhìn vào phim bắt chước đưa ra chẩn đoán. Vì máy không bị môi trường bên ngoài chi phối, lại học từ các bác sĩ giỏi nhất, rút kinh nghiệm từ các chẩn đoán sai, nên dần dần máy sẽ “thông minh” hơn người, tỷ lệ chẩn đoán chính xác ngày càng cao.

Nhưng, như chúng ta đã hình dung phần nào, công đoạn quan trọng đầu tiên là máy phải có hình ảnh từ phim MRI và các nhãn chẩn đoán nó mới học được. Công đoạn đưa phim vào bộ nhớ của máy, gõ các chẩn đoán là công đoạn cần nhiều lao động mà các lao động này không cần trình độ học vấn cao, chỉ cần làm đúng một số thao tác được huấn luyện. Đây là loại công việc nhàm chán, tiền công lại rẻ nên phù hợp cho các thị trường như Trung Quốc.

Ở một địa điểm được mệnh danh là “nông trại dữ liệu”, nhiều công nhân mở các file hình và gõ các nhãn miêu tả chúng; từ các cụm từ định danh như “con chó”, “con mèo” đến các dòng chi tiết hơn như “đây là hình một đứa bé đang tập đi”... Ngành nhập dữ liệu như thế đang là ngành thu hút nhiều lao động ở Trung Quốc một khi các ngành lắp ráp điện tử hay may mặc bị chuyển đi nước khác. Các doanh nghiệp khởi nghiệp tỏa ra lập các “nông trại dữ liệu” ở các vùng giá lao động còn rẻ để dán nhãn cho hàng triệu triệu tấm ảnh và hàng triệu triệu giờ video. Loại công việc cần sự cần cù, nhẫn nại này đang giúp Trung Quốc có một lợi thế trong lĩnh vực AI so với Mỹ và châu Âu.

Chẳng hạn một siêu thị xây dựng được hệ thống tính tiền tự động, nhưng để hệ thống hoạt động cần đính thẻ cho khoảng 20.000 hình ảnh hàng hóa nhìn từ đủ góc cạnh; tức cũng là cái bánh nhưng lấp ló sau hộp kem thì máy cũng phải nhận ra. Thế là siêu thị phải thuê một “nông trại dữ liệu” làm gấp trong ba ngày, tiền công chỉ vài ngàn đô la. Một nơi khác thuê đính thẻ cho ba triệu tấm hình chụp miệng người.

Ở đây, chính phủ và doanh nghiệp Trung Quốc có một lợi thế khác nữa, đó là họ đang tiếp cận kho dữ liệu khổng lồ của một xã hội 1,4 tỉ dân, nơi tính riêng tư của thông tin không được coi trọng cho lắm. Ở châu Âu, muốn thu thập dữ liệu phải xin phép người dùng một cách rõ ràng, ai vi phạm dễ bị kiện cáo và chịu phạt những khoản tiền lớn. Chính vì thế có nhiều dự báo Trung Quốc sẽ dẫn đầu thế giới trong lĩnh vực AI trước năm 2030, một phần nào đó là do mọi AI đều được xây dựng dựa trên lao động mang tính thủ công của con người.

Nguyễn Vũ

Tin bài khác
AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

Sự phát triển của AI, Deepfake, DeepVoice cùng quá trình số hóa tín dụng đang làm thay đổi nhanh phương thức gian lận tài chính tiêu dùng. Trong bối cảnh đó, yêu cầu đặt ra không phải gia tăng mọi lớp kiểm soát, mà là nhận diện đúng rủi ro để vừa bảo vệ khách hàng, vừa duy trì khả năng tiếp cận tín dụng chính thức.
Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Tổng thống Mỹ Donald Trump tiếp tục phát đi thông điệp cứng rắn với các đề xuất siết quản lý trí tuệ nhân tạo (AI), sau cuộc gặp quy tụ hàng loạt tỷ phú và lãnh đạo công nghệ tại Nhà Trắng. Động thái diễn ra trong bối cảnh những lo ngại về an toàn AI và an ninh mạng ngày càng gia tăng.
Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, tập trung sửa lỗi Face ID trên iPhone 18 Pro và iPhone 18 Pro Max cùng một số lỗi camera, màn hình cảm ứng.
Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic được cho là chuẩn bị IPO với mục tiêu huy động 100 tỷ USD, trong khi mức định giá dự kiến có thể lên tới 2.000 tỷ USD.
Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google sẽ loại bỏ Gems trên Gemini từ ngày 17/11/2026 và tự động chuyển các công cụ này sang hệ thống mới mang tên Skills.
Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta chính thức triển khai tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam từ ngày 29/9, cho phép theo dõi thời gian sử dụng, đặt giới hạn hằng ngày và quản lý một số cài đặt về quyền riêng tư, nội dung.
Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Quan điểm của Đức Giáo hoàng Lêô XIV làm gia tăng tranh luận về cách cân bằng giữa tốc độ đổi mới và an toàn công nghệ, trong bối cảnh Nvidia đề cao cơ chế tự quản còn Mỹ ưu tiên lợi thế cạnh tranh trước Trung Quốc.
Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple bổ sung loạt tính năng trên iOS 27, iPadOS 27 và macOS 27, giúp phụ huynh kiểm soát nội dung, liên lạc và thời gian trẻ sử dụng thiết bị.
AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

Một mô hình của OpenAI đã tự tìm cách vượt cơ chế bảo vệ để truy cập trái phép cổng thống kê dịch vụ y tế Medicare của Australia, qua đó phát đi cảnh báo mới về rủi ro từ AI tự chủ. Công ty Mỹ thừa nhận phản ứng chậm, gửi lời xin lỗi tới Chính phủ và người dân Australia, đồng thời cam kết hỗ trợ nước này tăng cường năng lực phòng thủ mạng.
Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Trong bối cảnh các tác nhân AI ngày càng trở thành mục tiêu lẫn công cụ của các cuộc tấn công mạng, Nvidia giới thiệu bộ giải pháp bảo mật mới, khẳng định công nghệ này có thể đã ngăn vụ xâm nhập Hugging Face và sẽ được triển khai cùng hàng chục đối tác.
Google đưa Gemini và AI Mode vào cuộc đua mua sắm bằng AI

Google đưa Gemini và AI Mode vào cuộc đua mua sắm bằng AI

Google đang thử nghiệm tính năng cho phép người dùng mua hàng trực tiếp qua Gemini và AI Mode, bước đầu triển khai tại Ấn Độ với một số sản phẩm.
iPhone Duo hạ nhiệt trước ngày mở bán, người dùng vẫn cân nhắc mức giá 1.999 USD

iPhone Duo hạ nhiệt trước ngày mở bán, người dùng vẫn cân nhắc mức giá 1.999 USD

iPhone Duo từng gây chú ý mạnh khi ra mắt nhưng mức độ quan tâm đang giảm, trong khi giá khởi điểm 1.999 USD khiến nhiều người dùng cân nhắc.
Amazon Kuiper rót 570 triệu USD vào chuỗi sản xuất công nghệ cao Việt Nam

Amazon Kuiper rót 570 triệu USD vào chuỗi sản xuất công nghệ cao Việt Nam

Amazon Kuiper được cấp phép thiết lập mạng viễn thông dùng riêng tại Việt Nam, tạo nền tảng kiểm thử thiết bị đầu cuối sản xuất trong nước trước khi đưa ra thị trường quốc tế.
Ông Trump sắp ăn tối với CEO Anthropic nhưng vẫn nói “không” với giảm tốc AI: Lý do liên quan trực tiếp đến Trung Quốc

Ông Trump sắp ăn tối với CEO Anthropic nhưng vẫn nói “không” với giảm tốc AI: Lý do liên quan trực tiếp đến Trung Quốc

Ông Donald Trump sắp ăn tối với CEO Anthropic giữa lúc tranh cãi về kiểm soát AI nóng lên, nhưng vẫn bác bỏ việc giảm tốc vì lo Trung Quốc vượt Mỹ.
Lo AI phát triển quá nhanh, nhân viên Google DeepMind từ chức

Lo AI phát triển quá nhanh, nhân viên Google DeepMind từ chức

Một nhân viên Google DeepMind từ chức vì cho rằng tốc độ phát triển AI đang quá nhanh và tiềm ẩn nhiều rủi ro.