Chỉ trong một tháng, Anthropic, OpenAI và Google đều ra mắt mô hình mới dành cho công việc agentic: AI không chỉ trả lời, mà còn bấm, gõ, gọi công cụ và hoàn thành việc. Dưới đây là những gì vừa ra mắt và ý nghĩa của nó nếu bạn đang điều hành doanh nghiệp, không phải một phòng thí nghiệm AI.
Anthropic: thế hệ Claude 5.1 và 5.5
Ngày 1/9, Anthropic ra mắt Claude Fable 5.1 và Claude Mythos 5.1, cùng một mô hình nhưng với hai mức bảo vệ. Fable 5.1 dùng rộng rãi; Mythos 5.1 chỉ dành cho chuyên gia đã được thẩm định trong lĩnh vực an ninh mạng và khoa học sự sống. Đi kèm là Enterprise Frontier Safeguards, cho phép doanh nghiệp lưu dữ liệu trên hạ tầng cloud của chính mình, triển khai theo từng giai đoạn từ mùa thu này.
Ba tuần sau, ngày 22/9, Claude Opus 5.5 ra mắt, là mô hình đầu tiên của dòng Claude 5.5. Anthropic cho biết mô hình đạt mức Fable 5.1 với phần lớn công việc và chi phí vận hành thấp hơn Opus 5 khoảng 40%, giá 4 USD cho một triệu token đầu vào và 20 USD cho một triệu token đầu ra. Kết quả trên benchmark sử dụng máy tính OSWorld 2.0 là 81,8%.
OpenAI: GPT-6 Astra, Sol và Luna
OpenAI định vị GPT-6 Astra là mô hình mạnh nhất của mình, có khả năng sử dụng máy tính như điền form trực tuyến, cập nhật dữ liệu CRM và sắp xếp lịch. OpenAI công bố 72,6% trên OSWorld 2.0; giá API là 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra.
Ngày 22/9, OpenAI bổ sung GPT-6 Sol và GPT-6 Luna, các phiên bản rẻ hơn trong cùng dòng. Sol có giá 2 / 10 USD cho một triệu token và theo OpenAI đạt điểm sử dụng máy tính tương đương Claude Opus 5 với chi phí mỗi tác vụ thấp hơn khoảng 80%. Luna chỉ 0,10 / 0,50 USD, đủ rẻ để chạy phân loại và điều phối khối lượng lớn.
Google: Gemini 3.8 Flash
Ngày 2/9, Google ra mắt Gemini 3.8 Flash, được mô tả là mô hình chủ lực thông minh nhất, cải thiện rõ ở kỹ thuật phần mềm, tác vụ agentic và suy luận nhiều bước. Giá ưu đãi là 0,75 / 3,75 USD cho một triệu token đến hết 31/12/2026, sau đó là 1,50 / 7,50 USD. Riêng Gemini 3.8 Flash Cyber cho phát hiện lỗ hổng chỉ dành cho chuyên gia bảo mật được cấp quyền.
Tiêu chuẩn mở: MCP và A2A chung một mái nhà
Ngày 27/8, giao thức Agent2Agent (A2A) gia nhập Agentic AI Foundation của Linux Foundation, cạnh Model Context Protocol (MCP), goose và AGENTS.md. MCP kết nối agent với công cụ và dữ liệu của bạn; A2A cho phép agent của các nhà cung cấp khác nhau tìm thấy nhau và giao việc cho nhau. Hơn 150 tổ chức ủng hộ A2A, trong đó có Google Cloud, AWS, Microsoft, Salesforce, SAP và ServiceNow.
Ý nghĩa với doanh nghiệp
- Sử dụng máy tính đã trở nên thực tế. Agent có thể thao tác trên web app và công cụ nội bộ không có API, mở ra khả năng tự động hóa cả hệ thống cũ.
- Chi phí mỗi tác vụ giảm nhanh. Các mô hình tầm trung như GPT-6 Sol, Gemini 3.8 Flash và Claude Opus 5.5 cho kết quả gần mức frontier với giá chỉ bằng một phần so với năm ngoái.
- Dùng “bậc thang mô hình”. Giao bước đơn giản cho mô hình rẻ nhất vượt qua bài kiểm tra của bạn, chỉ chuyển bước khó lên mô hình frontier.
- Bảo mật và nơi lưu dữ liệu đã thành tính năng sản phẩm. Mô hình giới hạn quyền và tùy chọn lưu dữ liệu trên hạ tầng khách hàng giúp các ngành bị quản lý chặt dễ phê duyệt hơn.
- Benchmark do nhà cung cấp tự công bố. Luôn thử trên dữ liệu và quy trình của chính bạn trước khi cam kết.
Bắt đầu từ đâu
Cách nhanh nhất để biến các phiên bản mới này thành giá trị là một pilot ngắn, có đo lường, trên một quy trình thật. DanaExperts triển khai pilot AI trả phí trong hai tuần, kết nối đúng mô hình với hệ thống của bạn và báo cáo độ chính xác, tốc độ, chi phí, để bạn quyết định dựa trên số liệu thay vì tin tức.


