AI Trung Quốc bị chê dốt toán - VietBF
 
 
 
News Library Technology Giải Trí Portals Tin Sốt Home

HOME

NEWS 24h

ZONE 1

ZONE 2

Phim Bộ

Phim Lẻ

Ca Nhạc

Breaking

Go Back   VietBF > World Box| Thế Giới > World News|Tin Thế Giới


Reply
 
Thread Tools
  #1  
Old  Default AI Trung Quốc bị chê dốt toán
Bất chấp có những nguồn lực khổng lồ đằng sau, các mô hình AI đã được chứng minh là gặp khó khăn ngay cả với kiến thức toán học cơ bản.

Làn sóng chatbot trí tuệ nhân tạo (AI) bùng nổ ở Trung Quốc đã mang đến cho người dùng nhiều cách tạo nội dung mới - bao gồm âm thanh, viết mã, hình ảnh, mô phỏng, video và văn bản chuẩn ngữ pháp - để giải trí và hỗ trợ các công việc hàng ngày.

Nhu cầu đó đã dẫn đến sự phát triển của hơn 200 mô hình ngôn ngữ lớn (LLM), công nghệ hỗ trợ các dịch vụ AI tạo sinh (GenAI) như ChatGPT. LLM là các thuật toán AI học sâu có thể nhận dạng, tóm tắt, dịch, dự đoán và tạo nội dung bằng cách sử dụng các tập dữ liệu rất lớn.

Bất chấp những nguồn lực khổng lồ đằng sau các chatbot, các mô hình AI đã được chứng minh là gặp khó khăn ngay cả với kiến thức toán học cơ bản khi được cư dân mạng thử nghiệm với màn bình chọn trong chương trình truyền hình thực tế Singer 2024 của Trung Quốc.


AI "dốt toán"

Trong chương trình tuần trước, nghệ sĩ Trung Quốc Tôn Nam nhận được 13,8% phiếu bầu trực tuyến, vượt qua ca sĩ người Mỹ Chanté Moore, người nhận được 13,11% phiếu bầu. Một số cư dân mạng đã tỏ ý chế giễu bảng xếp hạng khi đùa rằng con số Moore nhận được là lớn hơn mà vẫn thua (thực tế là ám chỉ ca sĩ Mỹ hay hơn nhưng lại thua cuộc).

Một người bình luận gợi ý nên so sánh hai con số trên bằng AI. Nhưng kết quả đưa ra đã gây bất ngờ. Cả chatbot Kimi của Moonshot AI và Baixiaoying của Baichuan ban đầu đều đưa ra câu trả lời sai khi cho rằng 13,11% lớn hơn 13,8%.

Samsung tạm ngừng giao tai nghe Galaxy Buds 3 Pro để kiểm soát lại chất lượng sau khi người dùng báo cáo vấn đề nút tai nghe dễ bị rách.

Về sau, hai chatbot này đã tự sửa lỗi cũng như xin lỗi người dùng về đáp án thiếu chính xác, giải thích lỗi sai là do áp dụng cái gọi là phương pháp tiếp cận chuỗi suy nghĩ – một phương pháp lý luận trong đó ứng dụng AI được hướng dẫn từng bước qua một vấn đề.

Cùng câu hỏi tương tự, mô hình Qwen LLM của Alibaba Group Holding phải sử dụng cả Python Code Interpreter để tính toán câu trả lời, trong khi Ernie Bot của Baidu phải thực hiện sáu bước để có được câu trả lời đúng.

Ngược lại, Doubao LLM của ByteDance đã phản hồi trực tiếp bằng cách đưa ra một ví dụ minh họa: "Nếu bạn có 9,90 USD và 9,11 USD, rõ ràng 9,90 USD là nhiều tiền hơn".

Wu Yiquan, một nhà nghiên cứu khoa học máy tính tại Đại học Chiết Giang ở Hàng Châu, giải thích về việc các mô hình AI gặp sai sót về kiến thức toán: "Thạc sĩ luật thì chẳng ai giỏi toán - điều này rất phổ biến".

Theo Wu, GenAI không sở hữu khả năng toán học và chỉ có thể dự đoán câu trả lời dựa trên dữ liệu đào tạo. Ông cho biết một số LLM hoạt động tốt trong các bài kiểm tra toán có thể là do "nhiễm dữ liệu", nghĩa là thuật toán ghi nhớ các câu trả lời đã có sẵn trong dữ liệu đào tạo.

"Thế giới AI được mã hóa - số, từ, dấu câu và khoảng trắng đều được xử lý như nhau. Do đó, bất kỳ thay đổi nào trong câu lệnh đều có thể ảnh hưởng đáng kể đến kết quả", Wu giải thích.

Vấn đề chung của AI

Vấn đề toán học nêu trên cho thấy công nghệ AI phát triển quá nhanh nhưng chưa hoàn thiện, không chỉ ở Trung Quốc mà còn ở nhiều nơi khác trên thế giới.

Theo Zheng Ge, giáo sư luật công tại Đại học Giao thông Thượng Hải, đây là tình huống có thể khiến Trung Quốc phải gác lại nỗ lực xây dựng luật AI thống nhất toàn quốc.
Trung Quốc có một công nghệ siêu phàm đến nỗi phải giấu kín vì sợ có người biết mình 'giỏi nhất thế giới'Trung Quốc có một công nghệ siêu phàm đến nỗi phải giấu kín vì sợ có người biết mình "giỏi nhất thế giới"

Trong Top500, người Mỹ đang đứng nhất. Thế nhưng nếu Trung Quốc nộp hồ sơ, kết quả có lẽ sẽ khác.

Zheng cho biết: "Phần lớn các chuyên gia tin rằng thời điểm để soạn thảo luật AI thống nhất toàn quốc có thể chưa phù hợp vì công nghệ này đang phát triển quá nhanh".

"Kiểm tra so sánh số" cho các mô hình AI đã trở nên phổ biến sau khi nhà nghiên cứu Bill Yuchen Lin của Viện Allen và kỹ sư tiên tiến Riley Goodside của công ty công nghệ Scale AI nêu bật những thiếu sót cơ bản về toán học của công nghệ này trên nền tảng truyền thông xã hội X.

Khi được hỏi số nào lớn hơn, 9,9 hay 9,11, ngay cả các LLM tiên tiến như GPT-4o của OpenAI, Claude 3.5 Sonnet và Mistral AI đều trả lời là 9,11.

Trong bài đăng trên X, Goodside cho biết ông không có ý định hạ thấp chương trình LLM, nhưng muốn giúp mọi người hiểu và khắc phục những sai sót của chúng.

"Những vấn đề liên quan đến giải toán kém trong LLM hiện đã được giảm thiểu rất tốt, nhưng còn rất nhiều lỗi gây ngỡ ngàng cho người dùng", ông viết. "Chúng ta nên sẵn sàng cho việc chúng sẽ còn sai ở nhiều lĩnh vực khác nữa".

VietBF@ Sưu tập

Cupcake01
R9 Tuyệt Đỉnh Tôn Sư
Release: 9 Hours Ago
Reputation: 7717


Profile:
Join Date: May 2019
Posts: 45,404
Last Update: None Rating: None
Attached Thumbnails
Click image for larger version

Name:	Screenshot 2024-07-27 at 14.04.12.jpg
Views:	0
Size:	101.0 KB
ID:	2404171  
Cupcake01_is_offline
Thanks: 39
Thanked 3,354 Times in 2,912 Posts
Mentioned: 0 Post(s)
Tagged: 0 Thread(s)
Quoted: 11 Post(s)
Rep Power: 51 Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5Cupcake01 Reputation Uy Tín Level 5
Reply

User Tag List


Facebook Comments


 
iPad Tablet Menu

HOME

Breaking News

Society News

VietOversea

World News

Business News

Other News

History

Car News

Computer News

Game News

USA News

Mobile News

Music News

Movies News

Sport News

ZONE 1

ZONE 2

Phim Bộ

Phim Lẻ

Ca Nhạc

Thơ Ca

Help Me

Sport Live

Stranger Stories

Comedy Stories

Cooking Chat

Nice Pictures

Fashion

School

Travelling

Funny Videos

NEWS 24h

HOT 3 Days

NEWS 3 Days

HOT 7 Days

NEWS 7 Days

HOT 30 Days

NEWS 30 Days

Member News

Tin Sôi Nổi Nhất 24h Qua

Tin Sôi Nổi Nhất 3 Ngày Qua

Tin Sôi Nổi Nhất 7 Ngày Qua

Tin Sôi Nổi Nhất 14 Ngày Qua

Tin Sôi Nổi Nhất 30 Ngày Qua
Diễn Đàn Người Việt Hải Ngoại. Tự do ngôn luận, an toàn và uy tín. Vì một tương lai tươi đẹp cho các thế hệ Việt Nam hãy ghé thăm chúng tôi, hãy tâm sự với chúng tôi mỗi ngày, mỗi giờ và mỗi giây phút có thể. VietBF.Com Xin cám ơn các bạn, chúc tất cả các bạn vui vẻ và gặp nhiều may mắn.
Welcome to Vietnamese American Community, Vietnamese European, Canadian, Australian Forum, Vietnamese Overseas Forum. Freedom of speech, safety and prestige. For a beautiful future for Vietnamese generations, please visit us, talk to us every day, every hour and every moment possible. VietBF.Com Thank you all and good luck.


All times are GMT. The time now is 16:21.
VietBF - Vietnamese Best Forum Copyright ©2006 - 2024
User Alert System provided by Advanced User Tagging (Pro) - vBulletin Mods & Addons Copyright © 2024 DragonByte Technologies Ltd.
Log Out Unregistered

Page generated in 0.06052 seconds with 12 queries