LIÊN HỆ HOTLINE/ZALO: 0981.243.678

Cognition ra mắt SWE-2: AI lập trình mạnh ngang đối thủ với chi phí chỉ bằng một phần tư
Cognition ra mắt SWE-2, kế nhiệm Devin với chi phí rẻ hơn 64%. Khám phá tác nhân lập trình AI hiệu suất cao, giúp doanh nghiệp tối ưu hóa ngân sách kỹ thuật.
Ngày 10 tháng 9 năm 2026, Cognition chính thức trình làng SWE-2, thế hệ tiếp theo của tác nhân lập trình (coding agent) Devin. Điểm nhấn lớn nhất của lần ra mắt này nằm ở khả năng tối ưu hóa chi phí: SWE-2 đạt hiệu suất tương đương với các mô hình hàng đầu thị trường nhưng với mức giá chỉ bằng một phần nhỏ. Cụ thể, trên bảng đo lường FrontierCode 1.1 Main – hệ thống đánh giá dựa trên khả năng được kỹ sư con người chấp nhận mã nguồn – SWE-2 đạt 50,0%. Con số này bám sát nút mức 50,9% của Fable 5.1 từ Anthropic và chỉ kém khoảng 3% so với GPT-6 Astra của OpenAI. Đáng chú ý, Cognition khẳng định chi phí vận hành SWE-2 thấp hơn 64% so với Fable 5.1 và chỉ bằng khoảng một phần tư so với Astra. Sự xuất hiện của SWE-2 đánh dấu bước chuyển mình quan trọng của các công cụ AI hỗ trợ lập trình, từ việc chạy đua sức mạnh thuần túy sang bài toán hiệu quả kinh tế cho doanh nghiệp. Thay vì coi AI là một khoản chi phí thử nghiệm, các đội ngũ kỹ thuật giờ đây có thể tích hợp SWE-2 vào quy trình làm việc hằng ngày như một phần ngân sách kỹ thuật chính thức nhờ tốc độ xử lý nhanh hơn và ít tiêu tốn tài nguyên hơn.
Tối ưu hóa hiệu suất thực tế và chiến lược mở rộng hệ sinh thái
SWE-2 được huấn luyện dựa trên mô hình nền tảng Kimi K3 của Moonshot AI với 2,8 nghìn tỷ tham số. Khác với cách tiếp cận thông thường là xây dựng các mô hình riêng biệt cho từng loại tác vụ, Cognition sử dụng phương pháp học tăng cường (reinforcement learning) trên ba mức độ nỗ lực khác nhau trong cùng một lần chạy. Kết quả là SWE-2 có khả năng thực hiện chỉnh sửa mã nguồn thực tế chỉ sau trung bình 18 bước, giảm đáng kể so với con số 48 bước của phiên bản tiền nhiệm SWE-1.7. Việc giảm thiểu các “vòng lặp vô nghĩa” giúp lập trình viên tiết kiệm thời gian chờ đợi và giảm bớt gánh nặng kiểm tra lại các đoạn mã lỗi thời hoặc không liên quan trong kho lưu trữ (repository).
Song song với việc nâng cấp mô hình, Cognition cũng thực hiện bước đi chiến lược khi thâu tóm Poke, tác nhân AI duy nhất được Apple hỗ trợ chính thức trong iMessage. Thương hiệu trị giá 26 tỷ USD này đang dần chuyển hướng từ các ứng dụng độc lập sang việc tích hợp AI vào các môi trường giao tiếp phổ thông như SMS. Dù SWE-2 vẫn còn bộc lộ hạn chế trên các bài kiểm tra phức tạp như Terminal-Bench 4 (đạt 27,3%, thấp hơn nhiều so với mức trên 55% của các đối thủ), nhưng trong phạm vi công việc kỹ thuật phần mềm thuần túy, mô hình này đang chứng minh ưu thế vượt trội về tốc độ và tính kinh tế.
Sự ra đời của SWE-2 cho thấy thị trường AI lập trình đang tiến tới giai đoạn trưởng thành, nơi giá trị thực tế được đo lường bằng sự cân bằng giữa năng lực xử lý và chi phí vận hành. Đối với các doanh nghiệp đang tìm cách tối ưu hóa quy trình phát triển phần mềm, việc thử nghiệm SWE-2 thông qua Devin Desktop hoặc CLI là một bước đi hợp lý để cắt giảm chi phí mà không làm suy giảm đáng kể chất lượng mã nguồn. Tuy nhiên, với các tác vụ đòi hỏi tư duy logic phức tạp vượt ngoài khuôn khổ lập trình, người dùng vẫn cần cân nhắc phối hợp với các mô hình đầu bảng như GPT-6 Astra hoặc Fable 5.1 để đảm bảo độ chính xác cao nhất.

Liên hệ qua Zalo