Tiêu dùng
Apple: AI chưa đủ thông minh như mọi người vẫn nghĩ
Phan Khôi - Thứ Ba, 22/10/2024 10:39 CH
Vietnet24h - Bài kiểm tra GSM-Symbolic từ Apple đã cho thấy rằng các mô hình AI như GPT-4 dễ gặp sai sót khi gặp dữ liệu mới. Kết quả này làm dấy lên câu hỏi về khả năng suy luận của AI trong thực tế.
Mới đây, nghiên cứu của Apple đã chỉ ra rằng các mô hình ngôn ngữ lớn (LLM) phổ biến hiện nay không sở hữu khả năng suy luận như nhiều người lo ngại. Thay vì thực sự thông minh, các LLM từ những tên tuổi lớn như OpenAI, Google và Meta chỉ đơn thuần là những hệ thống "khớp mẫu tinh vi" mà không đạt được mức độ suy luận logic thực thụ.
 
Mặc dù các LLM như GPT-4 của OpenAI được ca ngợi có khả năng tương tác tự nhiên và lập luận, nhóm nghiên cứu của Apple đã phát hiện ra rằng chúng thực sự không thể hiện sự hiểu biết sâu sắc về nội dung mà chúng xử lý. Các mô hình này chỉ đơn giản là phản hồi dựa trên mẫu đã được học mà không có khả năng tư duy hay phân tích thực sự.
 
Theo báo cáo, GSM8K hiện là bài kiểm tra phổ biến nhất để đánh giá kỹ năng suy luận của LLM. Tuy nhiên, do sự phổ biến này, nó có thể "nhiễm" dữ liệu, dẫn đến tình huống mà các LLM biết trước đáp án nhờ vào việc huấn luyện từ những dữ liệu đó. Để khắc phục vấn đề này, nhóm nghiên cứu đã phát triển tiêu chuẩn mới mang tên GSM-Symbolic, điều chỉnh các biến số trong câu hỏi nhưng giữ nguyên bản chất vấn đề.
 
Thông qua thử nghiệm trên 20 mô hình LLM nổi bật như GPT-4, OpenAI o1, Google Gemma 2 và Meta Llama 3, Apple đã nhận thấy "sự mong manh đáng ngạc nhiên" trong hiệu suất của các mô hình này. Mỗi khi biến số trong bài toán được thay đổi, độ chính xác của mô hình giảm vài phần trăm. Dù OpenAI o1 Preview có kết quả tốt nhất, mức độ chính xác của nó vẫn giảm đến 17,5%, trong khi LLM Phi 3 của Microsoft chứng kiến mức giảm lên đến 65%.
Một ví dụ điển hình được nhóm nghiên cứu sử dụng để kiểm tra là bài toán về số quả kiwi. Các LLM đã xử lý thông tin bằng cách trừ đi số lượng quả kiwi nhỏ hơn mà không nhận ra rằng kích thước không liên quan đến phép toán cần giải quyết. Điều này cho thấy các mô hình đang chuyển đổi câu nói thành phép toán mà không thực sự hiểu rõ ý nghĩa của chúng.
 
Nghiên cứu của Apple đã chỉ ra rằng có một "điểm yếu nghiêm trọng" trong khả năng hiểu khái niệm toán học cũng như phân biệt thông tin liên quan trong việc giải quyết vấn đề của các LLM. Mặc dù các mô hình AI đã bắt đầu hình thành khả năng tự suy luận, nhưng mức độ đó vẫn ở mức thấp và thực tế có thể đang bị cường điệu hóa về nguy cơ mà AI gây ra.
 
Hiện tại, các công ty liên quan như OpenAI, Google và Meta chưa đưa ra phản hồi nào về kết quả nghiên cứu của Apple, nhưng những phát hiện này có thể dẫn đến những thay đổi trong cách các nhà phát triển đánh giá và cải thiện khả năng của các mô hình AI trong tương lai.
Samsung giảm, Apple tăng: Thị phần smartphone tương đối cân bằng Vietnet24h - Sự tăng trưởng của Apple cùng với sự sụt giảm nhẹ từ Samsung đã đưa cả hai ông lớn này ngang bằng nhau với 18% thị phần trong quý III/2024. Cuộc chiến thị trường vẫn chưa ngã ngũ khi các hãng đang chuẩn bị cho mùa mua sắm cuối năm.
Tin khác cùng chuyên mục
Tin đọc nhiều
Apple vô hiệu hóa thông báo AI cho tin tức trong phần mềm iPhone beta của mình Vietnet24h - Apple đã vô hiệu hóa tính năng tóm tắt Apple Intelligence cho các ứng dụng tin tức dành cho người dùng phần mềm beta trên iPhone, iPad và Mac.
TV Samsung Neo QLED và TV Lifestyle đạt chứng nhận ‘EyeCare Circadian’ từ VDE Vietnet24h - Chứng nhận đánh giá độ thoải mái thị giác và khả năng hỗ trợ nhịp sinh học tự nhiên.
Samsung, Hyundai thu hút người mua nhà bằng dịch vụ giao hàng bằng robot Vietnet24h - Samsung C&T và Hyundai E&C đang cạnh tranh để thu hút chủ nhà và người mua nhà bằng dịch vụ giao hàng bằng robot tự lái của họ, được thiết kế để hoạt động trong các khu chung cư.
Apple Intelligence “thống trị” bộ nhớ iPhone: Dung lượng lên 7 GB Vietnet24h - Công nghệ AI tiên tiến từ Apple đang mang lại trải nghiệm đột phá, nhưng cái giá phải trả là dung lượng bộ nhớ ngày càng lớn. Với iOS 18.2, Apple Intelligence đã chiếm tới 7 GB, và dự kiến còn tăng thêm trong tương lai.
Khám phá Oppo Reno 13 5G: điện thoại mỏng nhất tầm giá với AI tiếng Việt đột phá Vietnet24h - Oppo Reno 13 5G không chỉ gây ấn tượng với thiết kế siêu mỏng mà còn sở hữu tính năng AI hỗ trợ tiếng Việt, đáp ứng nhu cầu sáng tạo và công việc hiệu quả. Với mức giá từ 15,99 triệu đồng, Reno 13 5G là lựa chọn lý tưởng cho những ai yêu thích công nghệ và sự tiện ích.
Samsung đưa “Eclipsa Audio” – công nghệ âm thanh 3D phát triển cùng Google lên dòng TV và Soundbar 2025 Vietnet24h - Eclipsa Audio sẽ có mặt trên toàn bộ dòng TV 2025 của Samsung, từ Crystal UHD đến Neo QLED 8K.
Khi AI y tế bịa chuyện: Lỗi nhỏ, hậu quả lớn Vietnet24h - Việc AI tự ý thêm thông tin sai lệch trong chẩn đoán và tư vấn y khoa đã dấy lên lo ngại về tính an toàn. Dù đầy tiềm năng, AI vẫn cần được giám sát chặt chẽ để tránh gây hậu quả nghiêm trọng.
Điều khiển AirPods chỉ bằng cử chỉ: iOS 18.4 mang đến trải nghiệm mới lạ Vietnet24h - Bản cập nhật iOS 18.4 đưa Siri lên tầm cao mới, giúp người dùng AirPods dễ dàng điều khiển thiết bị chỉ với một cái gật đầu.
Samsung nhảy vào cuộc chiến các thiết bị thực tế tăng cường Vietnet24h - Liệu Project Moohan có khắc phục được những nhược điểm của Vision Pro của Apple không?
OpenAI phát hành Sora, công cụ tạo video AI hấp dẫn Vietnet24h - OpenAI, công ty đã trở nên phổ biến vào năm ngoái nhờ sự phổ biến rộng rãi của ChatGPT, lần đầu tiên công bố Sora vào tháng 2 và sẽ triển khai cho người dùng tại Hoa Kỳ và các quốc gia khác vào thứ Hai (9/12).
Giải pháp đánh bay hôi miệng, lấy lại tự tin trong giao tiếp Vietnet24h - Hôi miệng không chỉ là vấn đề về sức khỏe mà còn ảnh hưởng trực tiếp đến sự tự tin và giao tiếp hàng ngày, đặc biệt đối với những người làm công việc tư vấn, kinh doanh hoặc giao tiếp trực tiếp. Mùi hôi khó chịu từ miệng khiến bạn gặp khó khăn trong các cuộc trò chuyện, khiến người khác ngại ngùng và ảnh hưởng đến mối quan hệ xã hội. Tuy nhiên, đừng lo lắng, vì những giải pháp đơn giản có thể giúp bạn khắc phục tình trạng này một cách hiệu quả.
Giới chức Mỹ kiện TikTok vì lo ngại thanh thiếu niên bị ảnh hưởng bởi nghiện mạng xã hội Vietnet24h - TikTok, nền tảng video nổi tiếng, đã trở thành mục tiêu của các vụ kiện từ 13 bang ở Mỹ, với cáo buộc gây nghiện cho thanh thiếu niên và làm tổn hại đến sức khỏe tâm thần của họ thông qua những thuật toán được thiết kế để tăng thời gian sử dụng.
Cách sử dụng ChatGPT vừa ra mắt chế độ giọng nói nâng cao cho trò chuyện âm thanh của OpenAI Vietnet24h - Mặc dù công cụ này phản hồi nhanh và có thể nói bằng nhiều giọng khác nhau, nhưng bạn có thể gặp phải giới hạn về tốc độ nếu sử dụng nhiều lần trong một ngày.
Đánh giá sơ bộ về iPhone 16 mới ra lò của Apple Vietnet24h - iPhone 16 Pro Max có thời lượng pin tốt hơn và camera tuyệt vời, nhưng Apple Intelligence vẫn chưa xuất hiện
Apple Watch Series 10 chỉ có những nâng cấp nhỏ, nhưng điểm cộng lớn là sạc nhanh hơn Vietnet24h - Apple Watch là một phần của bộ phận Thiết bị đeo, Gia đình và Phụ kiện của công ty, đã báo cáo doanh thu 8,1 tỷ đô la trong quý tài chính thứ ba, giảm 2% so với một năm trước.
Apple phát hành iOS 18 cho iPhone, nhưng không bao gồm Apple Intelligence Vietnet24h - Đây là bản cập nhật iPhone lớn nhất trong năm của Apple, nhưng bản cập nhật này không bao gồm Apple Intelligence, hệ thống AI sắp ra mắt của công ty.
Lý do nhiều người không ưa chuộng smartphone màn hình gập Vietnet24h - Đã nhiều năm trôi qua kể từ khi smartphone màn hình gập lần đầu tiên xuất hiện, nhưng doanh số của thiết bị đầy sáng tạo này vẫn chưa thể cạnh tranh với smartphone thông thường. Dù các thương hiệu liên tục thúc đẩy sản phẩm ra thị trường, nhiều người vẫn tỏ ra không mặn mà với dòng sản phẩm này. Vậy điều gì khiến smartphone màn hình gập chưa thể đạt được thành công mong đợi? Hãy cùng khám phá.
Liệu trẻ em có nên dùng Apple Watch? Vietnet24h - Apple vừa tung ra một trang web tiếp thị mới, quảng cáo Apple Watch như một cách để các bậc cha mẹ giữ liên lạc với con cái của họ.
Đánh giá sơ bộ về máy tính bảng Surface Pro của Microsoft Vietnet24h - Phiên bản thứ 11 của máy tính bảng chuyển đổi Surface Pro của Microsoft dựa trên chip Qualcomm tiêu thụ năng lượng, dẫn đến thời lượng pin hơn 8 giờ trong các thử nghiệm ban đầu.
Cảnh báo: mạng lưới lừa đảo với chiêu thức giả mạo ứng dụng bảo hiểm xã hội số Vietnet24h - Trong bối cảnh không gian mạng ngày càng trở nên phức tạp, Cục An toàn thông tin, thuộc Bộ Thông tin và Truyền thông, đã phát đi một thông báo khẩn cấp về những chiêu trò lừa đảo mới mẻ, đặc biệt là các vụ việc giả mạo ứng dụng VssID - Bảo hiểm xã hội số.