LG AI Research và SK Telecom vừa công bố hai mô hình AI nguồn mở quy mô hơn 700 tỷ tham số, đánh dấu giai đoạn quyết định trong chương trình phát triển AI chủ quyền của Hàn Quốc.
Chỉ trong vòng hai ngày cuối tháng 7, hai tập đoàn công nghệ hàng đầu Hàn Quốc là LG AI Research và SK Telecom đã lần lượt công bố các mô hình trí tuệ nhân tạo quy mô cực lớn dưới dạng mã nguồn mở. Động thái này diễn ra ngay trước khi chính phủ nước này tiến hành vòng đánh giá thứ hai của chương trình phát triển AI chủ quyền quốc gia.
Ngày 29/7, SK Telecom giới thiệu A.X K2 với quy mô 688 tỷ tham số. Hai ngày sau đó, LG AI Research trình làng K-EXAONE 2.0, sở hữu 750 tỷ tham số. Cả hai đều được phát hành trên nền tảng Hugging Face, sử dụng giấy phép Apache 2.0, cho phép doanh nghiệp và nhà phát triển tự do triển khai hoặc sửa đổi cho mục đích thương mại.

Ảnh: Patrick T. Fallon/AFP via Getty Images
Việc hai mô hình có quy mô tương đương xuất hiện gần như cùng lúc đã khiến cuộc cạnh tranh giữa LG và SK Telecom trở thành tâm điểm của chương trình AI chủ quyền do chính phủ Hàn Quốc hậu thuẫn.
Kiến trúc MoE: Nhiều tham số hơn nhưng không đồng nghĩa với chi phí cao hơn
Dù sở hữu hàng trăm tỷ tham số, cả hai mô hình đều được xây dựng dựa trên kiến trúc Mixture of Experts (MoE). Đây là phương pháp chia mạng nơ-ron thành nhiều nhóm chuyên gia độc lập, trong đó chỉ một số lượng nhỏ được kích hoạt khi xử lý từng truy vấn.
Cụ thể, K-EXAONE 2.0 chỉ sử dụng khoảng 37 tỷ tham số cho mỗi lần suy luận, trong khi A.X K2 kích hoạt khoảng 33 tỷ tham số. Điều này giúp các mô hình duy trì khả năng xử lý tương đương những hệ thống khổng lồ nhưng tiêu thụ ít tài nguyên hơn đáng kể.
Cả hai nền tảng đều hỗ trợ cửa sổ ngữ cảnh dài tới 262.144 token, đủ khả năng xử lý lượng dữ liệu tương đương nhiều cuốn tiểu thuyết trong cùng một phiên làm việc.
Tuy nhiên, mỗi hãng lại lựa chọn một hướng đi khác nhau. LG kết hợp cơ chế chú ý toàn cục với cơ chế xử lý cục bộ nhằm tối ưu hóa hiệu suất. Trong khi đó, SK Telecom phát triển công nghệ Sparse Gated Attention để chỉ tập trung vào những phần dữ liệu được xem là quan trọng nhất.
Hai chiến lược phát triển hoàn toàn khác biệt
Một trong những khác biệt lớn nhất nằm ở cách thức huấn luyện mô hình.
LG không xây dựng K-EXAONE 2.0 từ đầu mà mở rộng kiến trúc từ phiên bản K-EXAONE trước đó, vốn có quy mô 236 tỷ tham số. Sau khi mở rộng hệ thống, hãng tiếp tục thực hiện các giai đoạn tiền huấn luyện và tinh chỉnh nhằm cải thiện hiệu suất tổng thể.
Ngược lại, A.X K2 được SK Telecom phát triển hoàn toàn mới và huấn luyện trên khoảng 8.200 tỷ token dữ liệu. Công ty cũng áp dụng định dạng dấu phẩy động FP8 trong toàn bộ quy trình, giúp giảm đáng kể chi phí tính toán và dung lượng bộ nhớ cần thiết.
Theo giới chuyên môn, đây là một trong số ít mô hình AI quy mô lớn trên thế giới được xây dựng hoàn toàn bằng phương pháp này.
Mỗi mô hình đều sở hữu thế mạnh riêng
Kết quả đánh giá cho thấy K-EXAONE 2.0 nổi bật ở các tác vụ liên quan đến xử lý tài liệu dài và tìm kiếm thông tin bằng tiếng Hàn. Mô hình đạt điểm số cao trên những bộ kiểm thử như OpenAI-MRCR và Ko-LongBench, đồng thời cải thiện đáng kể khả năng lập trình tự động so với thế hệ trước.
Trong khi đó, A.X K2 thể hiện ưu thế rõ rệt ở các bài toán toán học và suy luận logic. Mô hình đạt 97,1 điểm trên bộ đánh giá AIME26, đồng thời giải thành công phần lớn các câu hỏi trong Kỳ thi Olympic Toán học quốc tế năm 2025.
Tuy nhiên, SK Telecom cũng thừa nhận A.X K2 chưa đạt kết quả như kỳ vọng đối với các tác vụ yêu cầu tìm kiếm thông tin mở trên internet. Đây được xem là một trong những điểm yếu cần tiếp tục cải thiện trước khi mô hình được triển khai rộng rãi.

Cuộc đua AI chủ quyền của Hàn Quốc đang bước vào giai đoạn cuối
Dự án AI chủ quyền của Hàn Quốc được khởi động từ năm 2025 với mục tiêu xây dựng các mô hình nền tảng hoàn toàn dựa trên công nghệ và dữ liệu trong nước.
Ban đầu, năm liên minh công nghệ được lựa chọn tham gia chương trình, bao gồm LG AI Research, SK Telecom, Naver Cloud, Upstage và NC AI. Tuy nhiên, sau vòng đánh giá đầu tiên, Naver Cloud và NC AI đã bị loại khỏi cuộc chơi.
Naver Cloud, đơn vị từng được xem là ứng cử viên sáng giá, không vượt qua vòng xét duyệt do sử dụng một số thành phần được phát triển từ mô hình Qwen của Alibaba, vi phạm tiêu chí yêu cầu toàn bộ hệ thống phải được xây dựng độc lập.
Đến đầu năm 2026, Motif Technologies cùng các đối tác là KAIST và Trillion Labs được bổ sung vào danh sách tham dự, nâng tổng số đội còn lại lên bốn.
Trong số đó, LG AI Research đạt số điểm cao nhất ở vòng đánh giá đầu tiên với 90,2 trên thang điểm 100.
Giấy phép Apache 2.0 mở đường cho tham vọng toàn cầu
Cả K-EXAONE 2.0 và A.X K2 đều được phát hành theo giấy phép Apache 2.0. Điều này đồng nghĩa với việc các tổ chức, doanh nghiệp và nhà phát triển trên toàn thế giới có thể sử dụng, điều chỉnh hoặc tích hợp hai mô hình vào sản phẩm thương mại mà không phải trả phí bản quyền.
Đây cũng được xem là chiến lược nhằm mở rộng ảnh hưởng của các công nghệ AI do Hàn Quốc phát triển ra thị trường quốc tế, thay vì giới hạn chúng trong phạm vi nội địa.
AI quốc gia dành cho hơn 50 triệu người dân
Những mô hình chiến thắng trong cuộc thi sẽ đóng vai trò quan trọng trong dự án “AI for All”, chương trình cung cấp trợ lý AI miễn phí cho toàn bộ người dân Hàn Quốc.
Theo kế hoạch, ít nhất một nửa khối lượng xử lý của hệ thống phải được vận hành bằng các mô hình AI nội địa đã được chứng nhận. Chính phủ Hàn Quốc hiện cũng đang đầu tư hàng tỷ USD để xây dựng hạ tầng điện toán, trung tâm dữ liệu và hệ sinh thái phần mềm phục vụ mục tiêu này.
Vòng đánh giá tiếp theo sẽ diễn ra trong tháng 8, trước khi hai cái tên xuất sắc nhất được lựa chọn vào cuối năm.
Ở thời điểm hiện tại, giới chuyên gia nhận định K-EXAONE 2.0 là lựa chọn phù hợp hơn đối với các tác vụ xử lý tài liệu quy mô lớn bằng tiếng Hàn, trong khi A.X K2 tỏ ra vượt trội ở các bài toán suy luận và tính toán phức tạp.

