Về trang News AI

Agent 27 tỷ tham số hạ cả Claude lẫn GPT-5.5 — nhỏ mà có võ

Cenix · 24.08.2026 · 2 phút đọc

Lab AI London do cựu binh DeepMind lập vừa cho thấy: để thắng ở một việc cụ thể, bạn không nhất thiết cần mô hình to nhất.

Agent 27 tỷ tham số hạ cả Claude lẫn GPT-5.5 — nhỏ mà có võ

Trong lúc các lab lớn đua nhau khoe mô hình ngày càng khổng lồ, một startup London mới ra khỏi chế độ stealth vài tuần lại đi hướng ngược lại — và thắng ở đúng cái sân họ chọn.

Inherent, lab do cựu nhân sự Google DeepMind sáng lập, vừa công bố agent tên Faraday. Nhiệm vụ: tự tái lập kết quả của các bài báo khoa học đã xuất bản mà không được cho biết đáp án trước. Đối thủ so kè là Claude Opus 4.8 của Anthropic và GPT-5.5 của OpenAI — cả hai đều là mô hình frontier cỡ lớn.

Kết quả: Faraday thắng. Điểm đáng nói là Faraday chạy trên Qwen 3.6, một mô hình chỉ 27 tỷ tham số.

Không phải thắng, mà là cách thắng

Đồng sáng lập kiêm chief scientist Edward Hughes nói với TechCrunch rằng chuyện vượt các agent frontier không phải điều họ tâm đắc nhất.

“Điều thú vị nhất với chúng tôi không hẳn là kết quả đánh bại các agent frontier — dĩ nhiên chúng tôi cũng thích điều đó — mà là cách chúng tôi xây dựng nó.”

Mục tiêu Inherent đặt ra cao hơn độ chính xác: họ muốn Faraday có “research taste” — bản năng biết thí nghiệm nào đáng làm và thiết kế nó ra sao. Dạy máy cái thứ mơ hồ như “gu” thì rất khó, nên họ dựa vào reinforcement learning thay vì nhồi luật.

Triết lý này còn quyết định cả những gì họ không làm: thay vì tự viết công cụ code riêng, Inherent cho Faraday dùng luôn GPT-5.5 Codex của OpenAI — giống như nhà khoa học thật dùng phần mềm có sẵn chứ không tự dựng mọi thứ.

Inherent gọi vốn seed 50 triệu USD, hiện có một tá nhân sự làm việc trực tiếp tại văn phòng King’s Cross, và dự định tăng lên “khoảng 20 đến 25 người” cuối năm nay.

Theo mấy fen, hướng đi “model nhỏ + agent thiết kế khéo” có phải là tương lai không, hay rồi cũng bị scale đè bẹp? Comment cho tui nghe.

Nguồn tham khảo: TechCrunch

Nguồn: TechCrunch