
Ba liên danh do SK Telecom, KT và Kakao dẫn dắt được chọn phát triển dịch vụ “AI cho mọi người” tại Hàn Quốc. Các bên dự kiến dùng tổng cộng 512 GPU NVIDIA B200 do chính phủ cung cấp để xây dựng chatbot và AI agent miễn phí trong năm.
Đang chuẩn bị bài viết bản địa hóa và thông tin nguồn.
Chỉ tìm trong nội dung đã xác minh và xuất bản.

Ba liên danh do SK Telecom, KT và Kakao dẫn dắt được chọn phát triển dịch vụ “AI cho mọi người” tại Hàn Quốc. Các bên dự kiến dùng tổng cộng 512 GPU NVIDIA B200 do chính phủ cung cấp để xây dựng chatbot và AI agent miễn phí trong năm.

Meta đã giới thiệu Muse Glimmer, mô hình open-weight 30 tỷ tham số được chưng cất từ Muse Spark và hướng đến quy trình AI tác tử chạy trên thiết bị. Thông tin ban đầu đáng chú ý, nhưng chưa đủ để kết luận về hiệu năng, yêu cầu phần cứng hay mức độ sẵn sàng cho production.

AI agent không ủy quyền tốt chỉ bằng cách chuyển prompt cho một agent khác. Hệ thống cần hợp đồng nhiệm vụ rõ ràng, cơ chế chọn đúng bên thực thi, kiểm tra đầu ra và khả năng truy vết toàn bộ quyết định.

Anthropic đang mở bản xem trước nghiên cứu của Model Hardware Standard cho một nhóm phòng thí nghiệm và nhà sản xuất tiên tiến. Đề xuất này hướng đến một đặc tả dùng chung để AI agent vận hành thiết bị vật lý an toàn hơn, nhưng các chi tiết kỹ thuật và mô hình quản trị vẫn cần được làm rõ.

Anthropic giới thiệu Claude Fable 5.1 và Claude Mythos 5.1 là các mô hình tiên tiến dành cho lập trình và công việc tri thức. Thông tin hiện có chưa nêu benchmark, API, giá hay giới hạn ngữ cảnh, vì vậy đội ngũ kỹ thuật nên chờ tài liệu chi tiết và tự đánh giá trên workload thực tế.

Các tác nhân AI không chỉ tạo văn bản mà còn truy cập dữ liệu, gọi công cụ và thực hiện hành động với danh tính người dùng. Hướng dẫn từ AWS và hoạt động tấn công do Wiz quan sát cho thấy đội ngũ kỹ thuật phải bảo vệ toàn bộ đường đi từ người dùng, mô hình đến công cụ và hạ tầng.

Tác nhân AI đang được thử nghiệm trong các công việc bảo mật có tính hành động: kiểm tra cơ sở mã, khai thác lỗ hổng, đánh giá phạm vi ảnh hưởng và điều phối ứng phó. Những trường hợp từ AWS, HackerOne, Wiz và Cisco Talos cho thấy tiềm năng tăng tốc lớn, đồng thời đặt ra yêu cầu nghiêm ngặt về quyền hạn, bằng chứng và kiểm soát vận hành.

Trọng tâm phát triển AI agent đang chuyển từ viết prompt sang xây dựng lớp vận hành gồm kỹ năng, bộ nhớ, MCP, đánh giá hành vi, thông tin xác thực và môi trường thực thi. Với đội ngũ web, đây là bước chuyển từ bản demo có thể chạy sang một hệ thống có thể kiểm thử, kiểm soát và bảo trì.

Các tích hợp mới quanh LangChain, Nevermined và Binance đang đưa AI agent từ chỗ đề xuất hành động sang trực tiếp mua dịch vụ hoặc thực hiện giao dịch. Với nhà phát triển, thay đổi quan trọng không chỉ là kết nối thanh toán mà còn là thiết kế quyền hạn, giới hạn và khả năng kiểm toán.

Làn sóng công cụ mới quanh LangSmith cho thấy kỹ thuật AI agent đang vượt ra ngoài việc chọn mô hình, tập trung nhiều hơn vào đánh giá, phát hiện sự cố và kiểm thử trước khi phát hành. Môi trường tác vụ, agent harness và bộ nhớ tự sửa lỗi cũng trở thành những phần quan trọng của hệ thống production.

AI agent truy cập dữ liệu doanh nghiệp không nên chỉ hành động bằng một danh tính dịch vụ chung. AWS mô tả cách truyền ngữ cảnh quyền của người dùng để agent trả dữ liệu theo quyền của người yêu cầu.

Khi MCP đi vào thực tế, định nghĩa tool chỉ là điểm bắt đầu. Server cần hợp đồng rõ ràng, ranh giới quyền, vận hành được và chủ sở hữu chịu trách nhiệm.