Ai Cho Lap Trinh

So sánh 120+ mô hình LLM mã nguồn mở tốt nhất

Tác giả: SprinGO · 28/07/2026

Hướng dẫn công cụ Các LLM mã nguồn mở là một trong những xu hướng AI quan trọng nhất năm 2026. Và điều này hoàn toàn có lý: Các mô hình mã nguồn mở từ lâu...

Hướng dẫn công cụ

Các LLM mã nguồn mở là một trong những xu hướng AI quan trọng nhất năm 2026. Và điều này hoàn toàn có lý: Các mô hình mã nguồn mở từ lâu đã yếu hơn đáng kể so với những mô hình độc quyền.

Các LLM mã nguồn mở là một trong những xu hướng AI quan trọng nhất năm 2026. Và điều này hoàn toàn có lý: Các mô hình mã nguồn mở từ lâu đã yếu hơn đáng kể so với những mô hình độc quyền. 

DeepSeek V4 Pro (phát hành ngày 24 tháng 4 năm 2026), GLM-5.1 từ Z.ai, Kimi K2.6 từ Moonshot AI và Qwen3.5 từ Alibaba có thể cạnh tranh với các mô hình LLM độc quyền tốt nhất như Claude Opus 4.8, GPT-5.5 hoặc Gemini 3.1 Pro, và thậm chí còn vượt trội hơn chúng trên những tiêu chuẩn cụ thể như SWE-Bench Pro và HumanEval. Điểm tham chiếu độc quyền mới cho Terminal-Bench 2.1 là GPT-5.6 Sol (được cung cấp rộng rãi từ ngày 9 tháng 7 năm 2026, mô hình mặc định trong OpenAI Codex) ở mức 88,8%, Sol Ultra ở mức 91,9%. Sol đạt 64,6% trên SWE-Bench Pro (thấp hơn khoảng 15 điểm so với Claude Mythos 5 và Fable 5). Điểm số tương đương của các phần mềm mã nguồn mở khác trên Terminal-Bench 2.1 vẫn chưa được công bố.

Trong bài viết này, bạn sẽ tìm thấy một danh mục gồm hơn 120 LLM mã nguồn mở, bao gồm benchmark, giấy phép, giá API, cửa sổ ngữ cảnh và khả năng của chúng.

Tổng quan về tất cả các mô hình LLM mã nguồn mở

Phần này chứa mọi mô hình trọng số mở từ danh mục models.dev cùng với các mô hình kinh điển được tuyển chọn, sắp xếp theo ngày phát hành theo mặc định, hiển thị thêm dữ liệu, chẳng hạn như phương thức, ngưỡng kiến ​​thức, đầu ra tối đa hoặc số lượng nhà cung cấp API:

 Mô hình  Nhà phát triển  Tham số Ngữ cảnhMMLUToán họcCodeSuy luậnCông cụGiấy phépGiá inputGiá outputNgày phát hành
Laguna XS 2.1
Poolside33B (3B hoạt động)256K70.9% SWE-Bench VerifiedOpenMDW-1.1$0.060$0.12Tháng 7 năm 2026
Ornith 1.0 31B
DeepReinforce31B256KMITTháng 6 năm 2026
Ornith 1.0 35B
DeepReinforce35B256K75.6% SWE-Bench VerifiedMITTháng 6 năm 2026
Ornith 1.0 397B
DeepReinforce397B256K82.4% SWE-Bench VerifiedMITTháng 6 năm 2026
Ornith 1.0 9B
DeepReinforce9B256K69.4% SWE-Bench VerifiedMITTháng 6 năm 2026
GLM-5.2
Z.ai1M91.2% GPQA62.1% SWE-Bench ProMIT$0.42$1.32Tháng 6 năm 2026
Kimi K2.7 Code
Moonshot AI1T (32B hoạt động)256K89.6% GPQA67.4% Terminal-BenchMIT đã được sửa đổi$0.28$1.10Tháng 6 năm 2026
Kimi K2.7 Code Highspeed
Moonshot AI1T (32B hoạt động)256K89.6% GPQA67.4% Terminal-BenchMIT đã được sửa đổi$1.90$8.00Tháng 6 năm 2026
North Mini Code
Cohere250K61% SWE-Bench VerifiedTháng 6 năm 2026
MiMo-V2.5-Pro-UltraSpeed
Xiaomi1MMIT$1.31$2.61Tháng 6 năm 2026
Nemotron 3 Ultra 550B A55B
NVIDIA550B (55B hoạt động)1M86.8% MMLU-Pro87% GPQA89% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.10$0.10Tháng 6 năm 2026
MiniMax-M3
MiniMax500K92.9% GPQA80.5% SWE-Bench VerifiedMIT$0.28$1.10Tháng 6 năm 2026
Step 3.7 Flash
StepFun250K76.5% SWE-Bench VerifiedApache 2.0$0.20$1.15Tháng 5 năm 2026
Command A Plus
Cohere125KCC BY-NC-4.0$2.50$10.00Tháng 5 năm 2026
Mistral Medium 3.5
Mistral AI128B256K77.6% SWE-Bench Verified$1.50$6.90Tháng 4 năm 2026
Nemotron 3 Nano Omni 30B A3B Reasoning
NVIDIA30B (3B hoạt động)250K77.3% MMLU-Pro72.2% GPQA63.2% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.11$0.42Tháng 4 năm 2026
Laguna M.1
Poolside225B (23B hoạt động)256K74.6% SWE-Bench VerifiedApache 2.0$0.20$0.40Tháng 4 năm 2026
Laguna XS.2
Poolside33B (3B hoạt động)256K69.9% SWE-Bench VerifiedApache 2.0$0.20$0.40Tháng 4 năm 2026
DeepSeek V4 Flash
DeepSeek284B (13B hoạt động)1M83% MMLU-Pro85% GPQA88% LiveCodeBenchMIT$0.084$0.17Tháng 4 năm 2026
DeepSeek V4 Pro
DeepSeek1.6T (49B hoạt động)1M87.5% MMLU-Pro90.1% GPQA93.5% LiveCodeBenchMIT$0.35$0.70Tháng 4 năm 2026
Qwen3.6 27B
Alibaba27B256K86.2% MMLU-Pro87.8% GPQA77.2% SWE-Bench VerifiedApache 2.0$0.20$0.76Tháng 4 năm 2026
MiMo-V2.5
Xiaomi1M86.3% MMLU56.1% SWE-Bench ProMIT$0.11$0.28Tháng 4 năm 2026
MiMo-V2.5-Pro
Xiaomi1M89.4% MMLU78.9% SWE-Bench VerifiedMIT$0.40$0.80Tháng 4 năm 2026
Kimi K2.6
Moonshot AI1T (32B hoạt động)256K84.6% MMLU-Pro90.5% GPQA92% HumanEvalMIT đã được sửa đổi$0.28$1.10Tháng 4 năm 2026
Hy3 preview
Tencent250K87.4% MMLU87.2% GPQA74.4% SWE-Bench VerifiedTencent Hunyuan Community$0.063$0.21Tháng 4 năm 2026
Qwen3.6 35B-A3B
Alibaba35B (3B hoạt động)256K85.2% MMLU-Pro86% GPQA73.4% SWE-Bench VerifiedApache 2.0$0.11$0.48Tháng 4 năm 2026
GLM-5.1
Z.ai754B200K91.7% MMLU85.7% GPQA58.4% SWE-Bench ProMIT$0.30$2.15Tháng 4 năm 2026
Gemma 4 26B A4B IT
Google26B (4B hoạt động)256K82.6% MMLU-Pro82.3% GPQA77.1% LiveCodeBenchĐiều khoản sử dụng của Gemma$0.060$0.30Tháng 4 năm 2026
Gemma 4 31B IT
Google31B256K85.2% MMLU-Pro84.3% GPQA80% LiveCodeBenchĐiều khoản sử dụng của Gemma$0.10$0.30Tháng 4 năm 2026
Gemma 4 E2B IT
Google128K60% MMLU-Pro43.4% GPQA44% LiveCodeBenchĐiều khoản sử dụng của GemmaTháng 4 năm 2026
Gemma 4 E4B IT
Google128K69.4% MMLU-Pro58.6% GPQA52% LiveCodeBenchĐiều khoản sử dụng của GemmaTháng 4 năm 2026
Step 3.5 Flash 2603
StepFun250K32.6% Terminal-Bench HardApache 2.0$0.10$0.30Tháng 4 năm 2026
Nemotron Cascade 2 30B A3B
NVIDIA30B (3B hoạt động)250K79.8% MMLU-Pro76.1% GPQA87.2% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.14$0.60Tháng 3 năm 2026
MiniMax-M2.7
MiniMax200K81.8% MMLU-Pro89.8% GPQA79.9% SWE-Bench VerifiedMIT$0.24$0.96Tháng 3 năm 2026
MiniMax-M2.7-highspeed
MiniMax200K81.8% MMLU-Pro89.8% GPQA79.9% SWE-Bench VerifiedMIT$0.60$2.40Tháng 3 năm 2026
Mistral Small 4
Mistral AI119B250K71.2% GPQA17.4% Terminal-Bench HardApache 2.0$0.15$0.60Tháng 3 năm 2026
Nemotron VoiceChat
NVIDIA125KGiấy phép mô hình mở NVIDIATháng 3 năm 2026
Nemotron 3 Super 120B A12B
NVIDIA120B (12B hoạt động)256K83.7% MMLU-Pro79.2% GPQA81.2% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.050$0.25Tháng 3 năm 2026
Qwen3.5 122B-A10B
Alibaba122B (10B hoạt động)256K86.7% MMLU-Pro86.6% GPQA72% SWE-Bench VerifiedApache 2.0$0.12$0.92Tháng 2 năm 2026
Qwen3.5 27B
Alibaba27B256K86.1% MMLU-Pro85.5% GPQA72.4% SWE-Bench VerifiedApache 2.0$0.086$0.69Tháng 2 năm 2026
Qwen3.5 35B-A3B
Alibaba35B (3B hoạt động)256K85.3% MMLU-Pro84.2% GPQA74.6% LiveCodeBenchApache 2.0$0.057$0.46Tháng 2 năm 2026
Qwen3.5 9B
Alibaba9B256K82.5% MMLU-Pro81.7% GPQA65.6% LiveCodeBenchApache 2.0$0.040$0.15Tháng 2 năm 2026
Sarvam 30B
Sarvam AI30B125K85.1% MMLU66.5% GPQA70% LiveCodeBench$0.020$0.10Tháng 2 năm 2026
Qwen3.5 397B-A17B
Alibaba397B (17B hoạt động)256K87.8% MMLU-Pro88.4% GPQA76.4% SWE-Bench VerifiedApache 2.0$0.17$1.03Tháng 2 năm 2026
MiniMax-M2.5-highspeed
MiniMax200K85.2% MMLU-Pro85.2% GPQA75.8% SWE-Bench VerifiedMIT$0.60$2.40Tháng 2 năm 2026
MiniMax-M2.5
MiniMax200K85.2% MMLU-Pro85.2% GPQA75.8% SWE-Bench VerifiedMIT$0.11$0.88Tháng 2 năm 2026
GLM-5
Z.ai744B200K96% MMLU94% GPQA94.2% HumanEvalMIT$0.30$1.90Tháng 2 năm 2026
Step 3.5 Flash
StepFun250K84.4% MMLU-Pro83.5% GPQA74.4% SWE-Bench VerifiedApache 2.0$0.090$0.30Tháng 1 năm 2026
GLM-4.7-Flash
Z.ai200K75.2% GPQA59.2% SWE-Bench VerifiedMIT$0.040$0.30Tháng 1 năm 2026
GLM-4.7-FlashX
Z.ai200K75.2% GPQA59.2% SWE-Bench VerifiedMIT$0.060$0.40Tháng 1 năm 2026
Kimi K2.5
Moonshot AI1T (32B hoạt động)256K92% MMLU87.6% GPQA99% HumanEvalMIT đã được sửa đổi$0.30$1.50Tháng 1 năm 2026
MiniMax-M2.1
MiniMax230B (10B hoạt động)200K88% MMLU-Pro83% GPQA74% SWE-Bench VerifiedMIT$0.27$0.95Tháng 12 năm 2025
GLM-4.7
Z.ai200K84.3% MMLU-Pro85.7% GPQA73.8% SWE-Bench VerifiedMIT$0.15$0.80Tháng 12 năm 2025
MiMo-V2-Flash
Xiaomi256K84.9% MMLU-Pro83.7% GPQA80.6% LiveCodeBenchMIT$0.090$0.28Tháng 12 năm 2025
Nemotron 3 Nano 30B A3B
NVIDIA30B (3B hoạt động)256K78.3% MMLU-Pro73% GPQA68.3% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.050$0.20Tháng 12 năm 2025
Devstral 2
Mistral AI123B256K18.9% Terminal-Bench Hard$0.40$2.00Tháng 12 năm 2025
GLM-4.6V
Z.ai125KMIT$0.14$0.42Tháng 12 năm 2025
DeepSeek V3.2
DeepSeek685B (37B hoạt động)1M85% MMLU-Pro79.9% GPQA70.2% Aider PolyglotMIT$0.14$0.28Tháng 12 năm 2025
Kimi K2 Thinking
Moonshot AI1T (32B hoạt động)256K84.6% MMLU-Pro84.5% GPQA71.3% SWE-Bench VerifiedMIT đã được sửa đổi$0.30$1.20Tháng 11 năm 2025
Kimi K2 Thinking Turbo
Moonshot AI1T (32B hoạt động)256K84.6% MMLU-Pro84.5% GPQA71.3% SWE-Bench VerifiedMIT đã được sửa đổi$1.15$8.00Tháng 11 năm 2025
Nemotron Nano 12B v2 VL
NVIDIA12B125K77.1% MMLU-Pro64.1% GPQA69.4% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.20$0.60Tháng 10 năm 2025
MiniMax-M2
MiniMax230B (10B hoạt động)192K82% MMLU-Pro78% GPQA69.4% SWE-Bench VerifiedMIT$0.17$1.00Tháng 10 năm 2025
GLM-4.6
Z.ai355B (32B hoạt động)200K83.2% MMLU-Pro81% GPQA9.7% SWE-Bench ProMIT$0.29$1.14Tháng 9 năm 2025
Sarvam 105B
Sarvam AI105B128K90.6% MMLU78.7% GPQA71.7% LiveCodeBench$0.040$0.16Tháng 9 năm 2025
Qwen3-Next 80B-A3B Instruct
Alibaba80B (3B hoạt động)128K80.6% MMLU-Pro72.9% GPQA56.6% LiveCodeBenchApache 2.0$0.090$0.57Tháng 9 năm 2025
Qwen3-Next 80B-A3B (Thinking)
Alibaba80B (3B hoạt động)128K82.7% MMLU-Pro77.2% GPQA68.7% LiveCodeBenchApache 2.0$0.098$0.65Tháng 9 năm 2025
Nemotron Nano 9B v2
NVIDIA9B128K64% GPQA71.1% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.040$0.16Tháng 8 năm 2025
GLM-4.5V
Z.ai106B (12B hoạt động)64K5.3% Terminal-Bench HardMIT$0.29$0.86Tháng 8 năm 2025
GPT OSS 120B
OpenAI117B (5.1B hoạt động)128K90% MMLU80.1% GPQA62.4% SWE-Bench VerifiedApache 2.0$0.036$0.10Tháng 8 năm 2025
GPT OSS 20B
OpenAI21B (3.6B hoạt động)128K85.3% MMLU96% AIME69% LiveCodeBenchApache 2.0$0.029$0.13Tháng 8 năm 2025
GLM-4.5
Z.ai355B (32B hoạt động)128K90% MMLU79.1% GPQA22% Terminal-Bench HardMIT$0.29$1.14Tháng 7 năm 2025
GLM-4.5-Air
Z.ai106B (12B hoạt động)128K87.4% MMLU75% GPQA20.5% Terminal-Bench HardMIT$0.10$0.29Tháng 7 năm 2025
Llama 3.3 Nemotron Super 49B v1.5
NVIDIA49B128K79.5% MMLU-Pro72% GPQA73.6% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.10$0.40Tháng 7 năm 2025
Devstral Small
Mistral AI125K53.6% SWE-Bench VerifiedApache 2.0$0.10$0.30Tháng 7 năm 2025
Kimi K2
Moonshot AI1T (32B hoạt động)128K89.5% MMLU97.4% MATH71.6% SWE-BenchMIT đã được sửa đổi$0.10$1.90Tháng 7 năm 2025
Mistral Small 3.2
Mistral AI24B125K80.5% MMLU46.1% GPQAApache 2.0$0.075$0.20Tháng 6 năm 2025
Mistral Nemotron
NVIDIA125KGiấy phép mô hình mở NVIDIATháng 6 năm 2025
Llama 3.1 Nemotron 70B Instruct
NVIDIA70B125KLlama 3.1 CommunityTháng 4 năm 2025
Llama 3.1 Nemotron Ultra 253B
NVIDIA253B125K76% GPQA66.3% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.60$1.80Tháng 4 năm 2025
Llama 3.3 Nemotron Super 49B v1
NVIDIA49B128K66.7% GPQA45.5% LiveCodeBenchGiấy phép mô hình mở NVIDIA$0.15$0.15Tháng 4 năm 2025
Llama 4 Maverick 17B Instruct
Meta400B (17B hoạt động)1M80.5% MMLU-Pro69.8% GPQA43.4% LiveCodeBenchLlama 4 Community$0.12$0.59Tháng 4 năm 2025
Llama 4 Scout 17B Instruct
Meta109B (17B hoạt động)3.5M74.3% MMLU-Pro57.2% GPQA32.8% LiveCodeBenchLlama 4 Community$0.17$0.59Tháng 4 năm 2025
Qwen3 235B-A22B
Alibaba235B (22B hoạt động)128K87% MMLU92.3% AIME74.1% LiveCodeBenchApache 2.0$0.20$0.50Tháng 4 năm 2025
Qwen3 32B
Alibaba32B128K83.5% MMLU77% MATH78% HumanEvalApache 2.0$0.080$0.24Tháng 4 năm 2025
Qwen3-Coder 30B-A3B Instruct
Alibaba30B (3B hoạt động)256K15.2% Terminal-Bench HardApache 2.0$0.053$0.22Tháng 4 năm 2025
Qwen3-Coder 480B-A35B Instruct
Alibaba480B (35B hoạt động)256K38.7% SWE-Bench ProApache 2.0$0.20$0.80Tháng 4 năm 2025
Command A
Cohere111B250K85.5% MMLU50.8% GPQA12% Aider PolyglotCC BY-NC-4.0$2.50$10.00Tháng 3 năm 2025
Gemma 3 27B
Google27B128K67.5% MMLU-Pro42.4% GPQA39% LiveCodeBenchĐiều khoản sử dụng của Gemma$0.030$0.11Tháng 3 năm 2025
OLMo 2 32B
Allen Institute32B4K74% MMLU78.6% GSM8KApache 2.0Tháng 3 năm 2025
DeepSeek-R1
DeepSeek671B (37B hoạt động)125K90.8% MMLU97.3% MATH6.1% Terminal-Bench HardMIT$0.40$1.70Tháng 1 năm 2025
InternLM3 8B-Instruct
Shanghai AI Lab8B32K72.3% MMLU75% GSM8K75.6% HumanEvalApache 2.0Tháng 1 năm 2025
Llama-3.3-70B-Instruct
Meta70B125K86% MMLU83% MATH3% Terminal-Bench HardLlama 3.3 Community$0.050$0.23Tháng 12 năm 2024
Command R7B
Cohere7B125K65.2% MMLU26.3% GPQA9% LiveCodeBenchCC BY-NC-4.0$0.038$0.15Tháng 12 năm 2024
DeepSeek-V3
DeepSeek671B (37B hoạt động)128K88.5% MMLU90.2% MATH85% HumanEvalMIT$0.25$1.00Tháng 12 năm 2024
Falcon 3 10B
TII10B32K73.1% MMLU58% MATHGiấy phép FalconTháng 12 năm 2024
Falcon 3 7B
TII7B32K67.4% MMLU70.8% GSM8KGiấy phép FalconTháng 12 năm 2024
Phi-4
Microsoft14B16K84.8% MMLU56.1% GPQA82.6% HumanEvalMIT$0.060$0.14Tháng 12 năm 2024
Mistral Large 2.1
Mistral AI123B128K84% MMLU76.9% MATH82% HumanEvalGiấy phép nghiên cứu Mistral$2.00$6.00Tháng 11 năm 2024
Mistral Large 3
Mistral AI675B (41B hoạt động)256K67.2% GPQA15.9% Terminal-Bench Hard$0.50$1.50Tháng 11 năm 2024
Pixtral Large (latest)
Mistral AI125KGiấy phép nghiên cứu Mistral$2.00$6.00Tháng 11 năm 2024
OLMo 2 13B
Allen Institute13B4K68.2% MMLU71.4% GSM8KApache 2.0Tháng 11 năm 2024
Pixtral 12B
Mistral AI12B125K69.2% MMLU48.1% MATH72% HumanEvalApache 2.0$0.15$0.15Tháng 9 năm 2024
Qwen2.5-VL 72B Instruct
Alibaba72B128K71.2% MMLU-Pro49% GPQA87.8% HumanEvalGiấy phép Qwen$0.13$0.40Tháng 9 năm 2024
Qwen2.5-32B-Instruct
Alibaba32B128K83.1% MMLU75.5% MATH78.9% HumanEvalApache 2.0$0.29$0.86Tháng 9 năm 2024
Qwen2.5-72B-Instruct
Alibaba72B128K85.3% MMLU82.3% MATH82% HumanEvalGiấy phép Qwen$0.062$0.23Tháng 9 năm 2024
Command R
Cohere32B125K26.8% GPQA11% LiveCodeBenchCC BY-NC-4.0$0.15$0.60Tháng 8 năm 2024
Command R+
Cohere104B125K34.3% GPQA14.4% LiveCodeBenchCC BY-NC-4.0$0.15$0.60Tháng 8 năm 2024
Nemotron Mini 4B Instruct
NVIDIA4B125KGiấy phép mô hình mở NVIDIATháng 8 năm 2024
Mistral Nemo
Mistral AI125K68% MMLUApache 2.0$0.020$0.030Tháng 7 năm 2024
Llama 3.1 405B Instruct
Meta405B128K88.6% MMLU73.8% MATH89% HumanEvalLlama 3.1 CommunityTháng 7 năm 2024
Llama 3.1 70B Instruct
Meta70B128K79.3% MMLU68% MATH80.5% HumanEvalLlama 3.1 Community$0.40$0.40Tháng 7 năm 2024
Llama 3.1 8B Instruct
Meta8B128K68.4% MMLU84.5% GSM8K72.6% HumanEvalLlama 3.1 Community$0.020$0.025Tháng 7 năm 2024
DeepSeek Coder V2
DeepSeek236B (21B hoạt động)128K78.5% MMLU75.7% MATH90.2% HumanEvalMITTháng 6 năm 2024
Qwen2-72B-Instruct
Alibaba72B128K84.2% MMLU89.5% GSM8K64.6% HumanEvalGiấy phép QwenTháng 6 năm 2024
Codestral (latest)
Mistral AI22B250K11.1% Aider PolyglotGiấy phép phi sản xuất Mistral$0.30$0.90Tháng 5 năm 2024
Granite Code 34B
IBM34B8K75.4% MMLU68.3% HumanEvalApache 2.0Tháng 5 năm 2024
Mistral 7B v0.3
Mistral AI7B32K62.5% MMLU52.2% GSM8KApache 2.0$0.25$0.25Tháng 5 năm 2024
Phi-3 Medium (14B)
Microsoft14B128K78% MMLU91% GSM8K62.2% HumanEvalMITTháng 5 năm 2024
Yi-1.5 34B
01.AI34B4K76.8% MMLU80.1% GSM8K75% HumanEvalApache 2.0Tháng 5 năm 2024
Mixtral 8x22B
Mistral AI141B (39B hoạt động)64K77.8% MMLU68% MATH75% HumanEvalApache 2.0$0.90$0.90Tháng 4 năm 2024
WizardLM-2 8x22B
Microsoft141B (39B hoạt động)64K77.2% MMLU83% GSM8K73.2% HumanEvalApache 2.0$0.49$0.49Tháng 4 năm 2024
DBRX
Databricks132B (36B hoạt động)32K73.7% MMLU66.9% GSM8K70.1% HumanEvalDatabricks Open ModelTháng 3 năm 2024
StarCoder2 15B
BigCode15B16K46% MMLU65.1% GSM8K36.6% HumanEvalBigCode Open RAIL-M v1Tháng 2 năm 2024
Code Llama 70B Instruct
Meta70B62% MMLU46.2% GSM8K67.8% HumanEvalLlama 2 CommunityTháng 1 năm 2024
InternLM2-Chat-20B
Shanghai AI Lab20B67% MMLU79.6% GSM8K67.1% HumanEvalApache 2.0Tháng 1 năm 2024
Mixtral 8x7B
Mistral AI46.7B (12.9B hoạt động)32K70.6% MMLU74.4% GSM8K40.2% HumanEvalApache 2.0$0.27$0.27Tháng 12 năm 2023
SOLAR 10.7B v1.0
Upstage10.7B4K66% MMLU69.9% GSM8KApache 2.0Tháng 12 năm 2023
DeepSeek LLM 67B
DeepSeek67B4K71.3% MMLU63.4% GSM8K40% HumanEvalDeepSeek LicenseTháng 11 năm 2023
Yi-34B
01.AI34B4K76.3% MMLU67.6% GSM8K23.2% HumanEvalApache 2.0Tháng 11 năm 2023
Falcon 180B
TII180B2K70.4% MMLU54.4% GSM8K35.4% HumanEvalGiấy phép FalconTháng 9 năm 2023

Những mô hình LLM mã nguồn mở tốt nhất năm 2026

Trước tiên, hãy cùng nhìn về phía trước: Vào ngày 16 tháng 7 năm 2026, Moonshot AI đã ra mắt Kimi K3, một mô hình MoE với 2,8 nghìn tỷ tham số (896 expert, 16 hoạt động trên mỗi token) cùng cửa sổ ngữ cảnh 1 triệu token, khả năng nhận diện hình ảnh gốc và đạt 93,5% trên GPQA Diamond. Hiện tại, K3 chỉ có sẵn thông qua ứng dụng và API (3 USD/15 USD cho mỗi triệu token, cũng có trên OpenRouter); trọng số dự kiến ​​sẽ được đưa lên Hugging Face vào ngày 27 tháng 7 năm 2026 (Moonshot sẽ công bố giấy phép chính xác khi phát hành; các mô hình trước đó sử dụng giấy phép MIT sửa đổi). Điều đó sẽ khiến K3 trở thành mô hình có trọng số mở lớn nhất từ ​​trước đến nay. Sau khi trọng số được công bố, nó sẽ được chuyển vào danh mục bên dưới. Cho đến lúc đó, bảng xếp hạng tháng 4 vẫn được áp dụng:

DeepSeek V4 Pro (phát hành ngày 24 tháng 4 năm 2026) là mô hình dẫn đầu mới. Mô hình MoE với 1,6 nghìn tỷ tham số chỉ kích hoạt 49 tỷ token, đạt điểm 87,5% trên MMLU-Pro, 90,1% trên GPQA Diamond và 93,5% trên LiveCodeBench. Sử dụng cùng giấy phép MIT như các sản phẩm khác trong dòng DeepSeek, và được tích hợp sẵn ngữ cảnh 1 triệu token với hiệu năng suy luận chỉ bằng khoảng 27% so với phiên bản 3.2.

Kimi K2.6 từ Moonshot AI là mô hình có hiệu năng mở tốt thứ hai: Đạt 92% trên HumanEval, 90,5% trên GPQA Diamond, 96,4% trên AIME 2026, với cửa sổ ngữ cảnh 256K và đầu vào video gốc. Sử dụng giấy phép MIT đã được sửa đổi, mô hình MoE với 1 nghìn tỷ tham số.

GLM-5.1 từ Z.ai (trước đây là Zhipu) dẫn đầu SWE-Bench Pro với 58,4%, vượt trội hơn GPT-5.4 (57,7%) và Claude Opus 4.6 (57,3%). Mô hình MoE với 754 tỷ tham số được huấn luyện hoàn toàn trên chip Huawei Ascend và được phát hành theo giấy phép MIT. Mô hình cùng loại về suy luận, GLM-5, đạt 96% trên MMLU và 94% trên GPQA, điểm số kiến ​​thức cao nhất trong không gian mã nguồn mở.

Kimi K2.5 vẫn đạt điểm HumanEval cao nhất trên mọi bảng xếp hạng (99,0) và dẫn đầu trên MATH-500 (98,0). Đây là mô hình mã nguồn mở tốt nhất dành riêng cho việc tạo mã khi độ trễ ít quan trọng hơn chất lượng tối ưu.

DeepSeek V4 Flash (284B / 13B hoạt động) là phiên bản tiết kiệm chi phí hơn của V4 Pro và là lựa chọn thiết thực nhất khi bạn muốn chất lượng hàng đầu trên một GPU cao cấp duy nhất.

Thế hệ trước vẫn rất hữu dụng: GPT-OSS-120B (mô hình có trọng số mở đầu tiên của OpenAI kể từ GPT-2), DeepSeek R1, Qwen3-235B-A22B-ThinkingLlama 4 Maverick đều vẫn mạnh mẽ, chỉ là không còn là những mô hình tiên tiến nhất nữa.

Dưới đây là so sánh 5 mô hình hàng đầu:

Tính năngDeepSeek V4 ProKimi K2.6GLM-5.1Kimi K2.5DeepSeek V4 Flash
Nhà phát triểnDeepSeekMoonshot AIZ.aiMoonshot AIDeepSeek
Giấy phép cho tất cả mọi ngườiMITMIT đã được sửa đổiMITMIT đã được sửa đổiMIT
Tất cả các tham số Mixture-of-Experts1.6T (49B hoạt động)1T754B1T284B (13B hoạt động)
Chạy cục bộ, ví dụ như với Ollama hoặc LM Studio
Nhu cầu phần cứng cục bộNhiều GPU hoặc lượng tử hóaNhiều GPU hoặc lượng tử hóaNhiều GPU hoặc lượng tử hóaNhiều GPU hoặc lượng tử hóaMột GPU cao cấp
Tính năng nổi bậtCửa sổ ngữ cảnh gốc 1 triệu tokenNgữ cảnh 256K, đầu vào video gốcĐược đào tạo hoàn toàn trên chip Huawei AscendDẫn đầu MATH-500 với điểm số 98.0Phiên bản tiết kiệm chi phí hơn của V4 Pro
Nguồn tham khảo: QuanTriMang · Kandy parfume · 28/07/2026

Cùng SprinGO kiến tạo doanh nghiệp vững từ gốc

SprinGO đồng hành cùng doanh nghiệp chuẩn hóa hệ thống quản trị, phát triển con người và tổ chức theo hướng tinh gọn, linh hoạt, phù hợp với thực tiễn vận hành.

Liên hệ SprinGO

Chủ đề liên quan

Gợi ý theo nội dung bài viết — bấm để xem thêm bài cùng chủ đề.

Zalo