Hướng dẫn tận dụng mô hình miễn phí trên OpenRouter: gợi ý cho xử lý văn bản, lập trình và Agent
Dựa trên bộ sưu tập mô hình miễn phí của OpenRouter tháng 5 năm 2026, tôi tổng hợp lại các mô hình miễn phí phù hợp cho xử lý văn bản, lập trình, workflow Agent và thử nghiệm ngữ cảnh dài, đồng thời giải thích hạn mức miễn phí, giới hạn tần suất và chiến lược sử dụng.
OpenRouter thay đổi rất nhanh về danh sách mô hình miễn phí. Một số mô hình miễn phí nổi bật trước đây có thể đột ngột bị gỡ, chuyển nhà cung cấp, bị giới hạn tần suất, hoặc không còn xuất hiện trong bảng xếp hạng mô hình miễn phí nữa. Đặc biệt là các mô hình miễn phí quy mô 1T trước đây mà nhiều người chú ý, giờ không còn phù hợp để làm lựa chọn khuyến nghị chính.
Vì vậy bài viết này không còn viết kiểu “một mô hình nào đó luôn mạnh nhất”, mà thay vào đó sắp xếp theo mục đích sử dụng: xử lý văn bản, lập trình, workflow Agent, thử nghiệm ngữ cảnh dài với các mô hình chuyên dụng.
Trang mô hình miễn phí của OpenRouter: https://openrouter.ai/models?q=free
Bộ sưu tập mô hình miễn phí của OpenRouter: https://openrouter.ai/collections/free-models
Trang tổng hợp mô hình miễn phí chính thức của OpenRouter cho thấy thứ hạng hiện tại được cập nhật theo dữ liệu sử dụng thực tế của tháng 5 năm 2026. OpenRouter cũng ghi rõ rằng mô hình miễn phí chủ yếu dùng cho thử nghiệm, học tập và thử nghiệm chi phí thấp; không có gì đảm bảo rằng chúng sẽ tiếp tục được cung cấp trong tương lai. Vì vậy, mô hình miễn phí phù hợp cho học tập, test, dự án cá nhân và workflow nhẹ, không nên dùng làm engine sản xuất dài hạn duy nhất.
Các tài liệu tham khảo chính: OpenRouter Free Models, OpenRouter Free Models Router, OpenRouter API Rate Limits, OpenRouter Pricing
Một, Nói ngắn gọn: bây giờ nên chọn mô hình miễn phí như thế nào?
Nếu bạn chỉ cần nhanh chóng tận dụng miễn phí, có thể nhớ sẵn tổ hợp này:
Xử lý văn bản: GLM 4.5 Air / Gemma 4 31B / gpt-oss-120b
Nhiệm vụ lập trình: Poolside Laguna M.1 / gpt-oss-120b / DeepSeek V4 Flash
Workflow Agent: Owl Alpha / Nemotron 3 Super / MiniMax M2.5
Rà soát phức tạp: Nemotron 3 Super / gpt-oss-120b / Trinity Large Thinking
Thử nghiệm ngữ cảnh dài: Owl Alpha / Nemotron 3 Super / DeepSeek V4 Flash
Dự phòng tổng quát: openrouter/freeĐề xuất của tôi là: đừng dồn vào một mô hình miễn phí duy nhất. Cốt lõi của miễn phí là “đa mô hình phân công + dự phòng”. Dùng mô hình văn bản cho viết/chỉnh sửa văn bản, mô hình coding cho code, mô hình Agent cho nhiệm vụ cần gọi công cụ và ngữ cảnh dài. Cách này ổn định hơn nhiều so với việc bám một mô hình duy nhất.
Hai, Các mô hình miễn phí hiện tại đáng ưu tiên theo dõi
Theo bộ sưu tập mô hình miễn phí hiện tại của OpenRouter, dưới đây là các mô hình đáng ưu tiên thử:
| Mức ưu tiên | Mã mô hình | Ứng dụng phù hợp | Nhận xét |
|---|---|---|---|
| S | openrouter/owl-alpha | Agent, ngữ cảnh dài, workflow tự động hóa | Mô hình đứng đầu trong bảng miễn phí hiện tại, ngữ cảnh 1M, phù hợp thử nghiệm cho các công cụ sản xuất như Claude Code / OpenClaw |
| S | nvidia/nemotron-3-super-120b-a12b:free | Suy luận phức tạp, rà soát code, đa Agent | Kiến trúc MoE 120B, ngữ cảnh 1M, phù hợp lập kế hoạch phức tạp, phân tích tài liệu dài và suy luận chéo tài liệu |
| S- | poolside/laguna-m.1:free | Lập trình, Coding Agent | Hướng tới nhiệm vụ kỹ thuật phần mềm phức tạp, hỗ trợ tool calling và reasoning, phù hợp sinh mã và gọi công cụ |
| A+ | openai/gpt-oss-120b:free | Suy luận, gọi công cụ, đầu ra cấu trúc hóa | Mô hình MoE mã nguồn mở của OpenAI, phù hợp suy luận tổng quát, thử nghiệm Agent và rà soát code |
| A+ | deepseek/deepseek-v4-flash:free | Ngữ cảnh dài, code, Agent | Ngữ cảnh 1M, phù hợp phản hồi nhanh, xử lý tác vụ ngữ cảnh dài và coding assistant |
| A | z-ai/glm-4.5-air:free | Tiếng Trung, hỏi đáp tổng quát, Agent nhẹ | Trải nghiệm tiếng Trung tốt, hỗ trợ chế độ thinking / non-thinking, phù hợp văn bản và suy luận nhẹ |
| A | minimax/minimax-m2.5:free | Tự động hóa văn phòng, Agent, code | Hướng tới nhiệm vụ sản xuất thực tế, phù hợp Word, Excel, PPT, code và workflow đa phần mềm |
| A- | poolside/laguna-xs-2:free | Lập trình nhẹ, Coding Agent | Thay thế nhẹ hơn cho Laguna M.1, phù hợp dự phòng cho code |
| A- | arcee-ai/trinity-large-thinking:free | Suy luận, Agent, rà soát phức tạp | Mô hình reasoning mã nguồn mở, phù hợp thí nghiệm workflow Agent giữ reasoning |
| B+ | baidu/cobuddy:free | Sinh code, AI Agent | Mô hình code của Baidu, hỗ trợ tool calling và reasoning, phù hợp code nhẹ và giải thích code tiếng Trung |
| B+ | openai/gpt-oss-20b:free | Suy luận nhẹ, đầu ra cấu trúc hóa | Nhẹ hơn 120B, phù hợp độ trễ thấp và tác vụ cấu trúc hóa phổ thông |
| B | nvidia/nemotron-3-nano-30b-a3b:free | Agent nhẹ, nghiên cứu private AI | MoE nhẹ, phù hợp thử nghiệm hệ thống agentic chuyên biệt |
| B | openrouter/free | Kiểm tra thử miễn phí | Tự động chọn mô hình miễn phí, tiện lợi nhưng chưa ổn định, không nên dùng cho debug chính thức |
Lưu ý: danh sách mô hình miễn phí thay đổi liên tục. Trước khi dùng thật, nên mở trang mô hình để xác nhận xem nó còn miễn phí không, có hỗ trợ tool calling không, độ dài ngữ cảnh bao nhiêu, và có giới hạn nhà cung cấp hay không.
Ba, Khuyến nghị mô hình miễn phí cho xử lý văn bản
Xử lý văn bản gồm biên tập bài tiếng Trung, tóm tắt, dịch, sắp xếp tài liệu dài, tổ chức knowledge base, viết email, tái diễn giải hướng dẫn kỹ thuật,…
Ưu tiên cho mô hình văn bản
| Mức ưu tiên | Mã mô hình | Ứng dụng phù hợp | Nhận xét |
|---|---|---|---|
| S | z-ai/glm-4.5-air:free | Hỏi đáp tiếng Trung, biên tập bài, suy luận nhẹ | Trải nghiệm tiếng Trung tốt, phù hợp làm mô hình văn bản chính hàng ngày |
| S- | google/gemma-4-31b-it:free | Văn bản đa ngôn ngữ, hiểu tài liệu, viết thông thường | Ổn định, tổng quát, phù hợp xử lý văn bản cơ bản và tác vụ đa ngôn ngữ |
| A+ | openai/gpt-oss-120b:free | Viết lại có cấu trúc, tóm tắt phức tạp, hệ thống hóa ý | Sức mạnh suy luận tốt, phù hợp rà soát văn bản phức tạp và tái cấu trúc logic |
| A | nvidia/nemotron-3-super-120b-a12b:free | Tài liệu dài, phân tích văn bản phức tạp | Phù hợp phân tích khối nội dung lớn, nhưng không phải lúc nào cũng tối ưu cho biên tập nhẹ tần suất cao |
| A- | deepseek/deepseek-v4-flash:free | Tổ chức với ngữ cảnh dài, tóm tắt nhanh | Phù hợp kịch bản cần nạp nội dung dài, log hoặc tài liệu dày |
| B+ | openrouter/free | Chat nhanh, test nhanh | Tiện lợi nhưng route không cố định |
Tổ hợp ưu tiên cho xử lý văn bản
- Biên tập bài tiếng Trung hàng ngày: z-ai/glm-4.5-air:free
- Văn bản đa ngôn ngữ và đọc hiểu tài liệu: google/gemma-4-31b-it:free
- Phân tích góc nhìn phức tạp: openai/gpt-oss-120b:free
- Sắp xếp cấu trúc tài liệu dài: nvidia/nemotron-3-super-120b-a12b:free
- Tổ chức ngữ cảnh siêu dài: deepseek/deepseek-v4-flash:free
Nếu bạn chỉ viết blog, chỉnh sửa bài, làm tóm tắt, không nhất thiết phải mở ngay mô hình lớn nhất. Bài tiếng Trung thông thường có thể thử trước z-ai/glm-4.5-air:free hoặc google/gemma-4-31b-it:free. Nếu cần rà soát luận điểm phức tạp, tái cấu trúc bài dài hoặc phân tích logic, chuyển sang openai/gpt-oss-120b:free hoặc nvidia/nemotron-3-super-120b-a12b:free.
Bốn, Khuyến nghị mô hình miễn phí cho lập trình
Tác vụ lập trình gồm viết Python, giải thích lỗi, sửa bug, sinh script, đọc kho mã, rà soát code, hỗ trợ phát triển AI Agent,…
Ưu tiên cho mô hình lập trình
| Mức ưu tiên | Mã mô hình | Ứng dụng phù hợp | Nhận xét |
|---|---|---|---|
| S | poolside/laguna-m.1:free | Coding Agent, phần mềm phức tạp | Hướng tới nhiệm vụ kỹ thuật phần mềm phức tạp, phù hợp sinh mã, gọi công cụ và workflow coding agentic |
| S- | openai/gpt-oss-120b:free | Suy luận code, đầu ra cấu trúc hóa, gọi công cụ | Phù hợp giải thích code, rà soát code và thử nghiệm Agent |
| A+ | deepseek/deepseek-v4-flash:free | Code ngữ cảnh dài, sửa nhanh | Phù hợp code dài, phản hồi nhanh và coding assistant |
| A | poolside/laguna-xs-2:free | Code nhẹ, Agent chi phí thấp | Phù hợp thay thế M.1 làm dự phòng |
| A | baidu/cobuddy:free | Sinh code, giải thích code tiếng Trung | Phù hợp task code nhẹ, đặc biệt giải thích tiếng Trung và thử nghiệm gọi công cụ |
| A- | minimax/minimax-m2.5:free | Nhiệm vụ kỹ thuật, tự động hóa văn phòng, Agent | Phù hợp tình huống tăng năng suất thực tế, không chỉ giới hạn trong code |
| B+ | nvidia/nemotron-3-super-120b-a12b:free | Rà soát code, phân tích kiến trúc | Phù hợp cố vấn cao cấp, không nên để nó tự động sửa toàn kho mã không giám sát |
Tổ hợp ưu tiên cho lập trình
- Mô hình chính sinh code: poolside/laguna-m.1:free
- Suy luận code và đầu ra cấu trúc hóa: openai/gpt-oss-120b:free
- Tác vụ code ngữ cảnh dài: deepseek/deepseek-v4-flash:free
- Dự phòng code nhẹ: poolside/laguna-xs-2:free
- Giải thích code tiếng Trung: baidu/cobuddy:free
- Rà soát code phức tạp: nvidia/nemotron-3-super-120b-a12b:free
Nếu bạn làm dự án gọi công cụ như Claude Code, Cline, Roo Code, OpenCode, đừng chỉ nhìn khả năng chat. Quan trọng hơn là:
1. Có hỗ trợ tool calling không; 2. Có thể ổn định đầu ra dạng có cấu trúc không; 3. Có hiểu ngữ cảnh dài không; 4. Có thể thực thi theo từng bước theo nhiệm vụ không; 5. Có dễ sửa file lung tung không.
Thứ tự của tôi là: poolside/laguna-m.1:free phụ trách sinh code, openai/gpt-oss-120b:free phụ trách suy luận và đầu ra cấu trúc hóa, nvidia/nemotron-3-super-120b-a12b:free phụ trách rà soát phức tạp và phán đoán kiến trúc.
Năm, Khuyến nghị mô hình miễn phí cho Agent / gọi công cụ
Mô hình Agent không phải là mô hình chat đơn thuần. Nó cần đọc yêu cầu, tách bước, gọi công cụ, đọc kết quả gọi công cụ, tiếp tục suy luận, và càng ít sai định dạng càng tốt.
Ưu tiên mô hình Agent
| Mức ưu tiên | Mã mô hình | Ứng dụng phù hợp | Nhận xét |
|---|---|---|---|
| S | openrouter/owl-alpha | Agent, ngữ cảnh dài, workflow tự động hóa | Mô hình đầu bảng miễn phí hiện tại, phù hợp thử nghiệm công cụ như Claude Code / OpenClaw |
| S | nvidia/nemotron-3-super-120b-a12b:free | Nhiều Agent, lập kế hoạch phức tạp, ngữ cảnh dài | Ngữ cảnh 1M, phù hợp lập kế hoạch tác vụ dài hạn, suy luận chéo tài liệu và nhiều bước |
| S- | minimax/minimax-m2.5:free | Tự động hóa văn phòng, Agent, workflow đa phần mềm | Hướng tới môi trường năng suất thực tế, phù hợp tư duy Agent văn phòng |
| A+ | openai/gpt-oss-120b:free | Tool calling, đầu ra cấu trúc hóa, suy luận | Phù hợp thử nghiệm framework Agent |
| A+ | poolside/laguna-m.1:free | Coding Agent | Phù hợp Agent về code |
| A | deepseek/deepseek-v4-flash:free | Agent ngữ cảnh dài, phản hồi nhanh | Phù hợp tác vụ thông lượng cao và ngữ cảnh dài |
| A- | arcee-ai/trinity-large-thinking:free | reasoning Agent, nhiệm vụ phức tạp | Phù hợp thử nghiệm workflow Agent giữ lại reasoning |
| B+ | z-ai/glm-4.5-air:free | Agent nhẹ, tác vụ tiếng Trung | Phù hợp dự phòng tổng quát |
| B | openrouter/free | Route miễn phí tạm thời | Tiện nhưng không kiểm soát được, không phù hợp debug chính thức |
OpenRouter còn có một route đặc biệt: openrouter/free.
Nó sẽ tự động chọn mô hình miễn phí có sẵn, thích hợp cho chat tạm và test nhanh. Nhưng nếu bạn đang viết framework Agent riêng, không nên dùng openrouter/free lâu dài, vì mỗi lần định tuyến có thể tới mô hình khác nhau, hành vi không ổn định khiến debug rất đau đầu.
Sáu, Nhận xét nhanh các mô hình trọng điểm
1. openrouter/owl-alpha
Trang mô hình: OpenRouter Owl Alpha
OpenRouter mô tả Owl Alpha là một mô hình đáng chú ý trong bảng miễn phí hiện tại. Trang của họ nhấn mạnh tới agentic workloads, tool use, long-context tasks, code generation, automated workflows và complex instruction execution, đồng thời ghi rõ tương thích với các công cụ sản xuất như Claude Code và OpenClaw.
Định vị của tôi:
Phù hợp: Agent, ngữ cảnh dài, workflow tự động hóa, thử nghiệm công cụ kiểu Claude Code
Không phù hợp: Môi trường sản xuất có yêu cầu ổn định cực caoNó rất phù hợp để test AgentLab, CLI kiểu Claude Code, lập kế hoạch tác vụ nhiều bước. Nhưng bản chất “alpha”, nên độ ổn định thực tế và phong cách đầu ra cần tự test.
2. nvidia/nemotron-3-super-120b-a12b:free
Trang mô hình: NVIDIA Nemotron 3 Super 120B A12B Free
NVIDIA Nemotron 3 Super là mô hình MoE 120B tham số, mỗi lần kích hoạt khoảng 12B tham số. OpenRouter hiện mô tả nó hỗ trợ ngữ cảnh 1M token, hướng tới long-term agent coherence, cross-document reasoning và multi-step task planning.
Định vị của tôi:
Phù hợp: Suy luận phức tạp, phân tích tài liệu dài, rà soát code, lập kế hoạch Agent
Không phù hợp: Tự động nắm quyền toàn bộ dự án mà không giám sátNó phù hợp làm “cố vấn cao cấp”: rà soát code, giải thích kiến trúc, lập kế hoạch tác vụ, phân tích văn bản dài. Nhưng nếu cắm trực tiếp vào công cụ tự viết code, nên thử quy mô nhỏ trước để tránh sửa file bừa hoặc đầu ra không ổn định.
3. poolside/laguna-m.1:free
Trang mô hình: Poolside Laguna M.1 Free
Laguna M.1 là mô hình coding agent của Poolside. Trang OpenRouter mô tả nó hướng tới nhiệm vụ phần mềm phức tạp, hỗ trợ tool calling và reasoning, phù hợp agentic coding workflows.
Định vị của tôi:
Phù hợp: Sinh code, giải thích code, Coding Agent, gọi công cụ
Không phù hợp: Viết văn bản dài tiếng Trung, chưa tự nhiên như mô hình văn bản tổng quátNếu bạn chỉ muốn chọn một mô hình code miễn phí, hãy ưu tiên thử cái này trước.
4. openai/gpt-oss-120b:free
Trang mô hình: OpenAI gpt-oss-120b Free
gpt-oss-120b là mô hình MoE mã nguồn mở của OpenAI. OpenRouter mô tả nó phù hợp cho high-reasoning, agentic và general-purpose use cases, và hỗ trợ native tool use, function calling, browsing và tạo đầu ra cấu trúc hóa.
Định vị của tôi:
Phù hợp: Suy luận phức tạp, đầu ra cấu trúc hóa, gọi công cụ, rà soát code
Không phù hợp: Thay thế một cách “chay” mọi mô hình trả phíNó phù hợp làm “tầng suy luận” hoặc “tầng rà soát” trong framework Agent. Nếu bạn thử nghiệm gọi công cụ, nó đáng thử hơn nhiều so với mô hình chat thông thường.
5. deepseek/deepseek-v4-flash:free
Trang mô hình: DeepSeek V4 Flash Free
DeepSeek V4 Flash là mô hình MoE tối ưu hiệu năng. Trang OpenRouter hiện tại ghi nó hỗ trợ cửa sổ ngữ cảnh 1M token, phù hợp coding assistants, chat systems và agent workflows.
Định vị của tôi:
Phù hợp: Ngữ cảnh dài, phản hồi nhanh, trợ lý code, workflow Agent
Không phù hợp: Viết tiếng Trung cần cảm giác ngôn ngữ caoĐiểm mạnh của nó là ngữ cảnh dài và hiệu năng. Nếu bạn cần nạp rất nhiều file, rất nhiều log, rất nhiều mô tả dự án thì đáng để test.
6. minimax/minimax-m2.5:free
Trang mô hình: MiniMax M2.5 Free
MiniMax M2.5 hướng tới năng suất thực tế (real-world productivity). Trang OpenRouter nói tới các môi trường Office như Word, Excel, PowerPoint và cũng nhấn mạnh coding expertise cùng planning.
Định vị của tôi:
Phù hợp: Tự động hóa văn phòng, xử lý tài liệu, tác vụ bảng tính, Agent năng suất
Không phù hợp: Lãng phí hạn mức cho việc chat tán gẫuNếu bạn nghiên cứu “AI giúp mình xử lý việc văn phòng thật”, mô hình này đáng được test riêng.
7. arcee-ai/trinity-large-thinking:free
Trang mô hình: Arcee AI Trinity Large Thinking Free
Trinity Large Thinking là mô hình reasoning mã nguồn mở của Arcee AI. Trang OpenRouter nhấn mạnh mô hình này phù hợp cho agentic workloads và reasoning tasks, và gợi ý các mô hình này nên giữ nguyên quá trình reasoning.
Định vị của tôi:
Phù hợp: Suy luận phức tạp, tách nhiệm vụ Agent, tác vụ rà soát
Không phù hợp: Chat tán gẫu độ trễ thấp và chỉnh sửa văn bản ngắn thông thườngNó có thể là phương án dự phòng reasoning bên cạnh gpt-oss-120b:free và nvidia/nemotron-3-super-120b-a12b:free.
Bảy, Thứ tự ưu tiên miễn phí cuối cùng của tôi
Bảng tổng hợp miễn phí
| Hạng | Mã mô hình | Ứng dụng chính | Lý do đề xuất |
|---|---|---|---|
| 1 | openrouter/owl-alpha | Agent, ngữ cảnh dài | Đứng đầu bảng miễn phí hiện tại, ngữ cảnh 1M, phù hợp thử nghiệm workflow tự động hóa |
| 2 | poolside/laguna-m.1:free | Lập trình, Coding Agent | Ưu tiên test trước cho tác vụ code |
| 3 | nvidia/nemotron-3-super-120b-a12b:free | Suy luận phức tạp, rà soát code | Ngữ cảnh 1M, phù hợp phân tích phức tạp và suy luận chéo tài liệu |
| 4 | openai/gpt-oss-120b:free | Suy luận, gọi công cụ | Phù hợp đầu ra cấu trúc hóa và test Agent |
| 5 | deepseek/deepseek-v4-flash:free | Ngữ cảnh dài, phản hồi nhanh | Ngữ cảnh 1M, phù hợp nhiệm vụ dài |
| 6 | minimax/minimax-m2.5:free | Agent văn phòng, tác vụ năng suất | Phù hợp workflow tài liệu, bảng tính, PPT |
| 7 | z-ai/glm-4.5-air:free | Mở rộng tiếng Trung, suy luận nhẹ | Mô hình dự phòng tiếng Trung, phù hợp biên tập bài và hỏi đáp thông thường |
| 8 | google/gemma-4-31b-it:free | Văn bản, đa ngôn ngữ, hiểu tài liệu | Dự phòng xử lý văn bản hàng ngày |
| 9 | arcee-ai/trinity-large-thinking:free | reasoning, rà soát Agent | Dự phòng cho suy luận phức tạp |
| 10 | baidu/cobuddy:free | Code nhẹ, giải thích code tiếng Trung | Dự phòng code |
| 11 | openrouter/free | Test tạm thời | Route tự động tiện lợi, nhưng không ổn định |
Nếu bạn chỉ muốn nhớ 5 mô hình
- Viết bài: z-ai/glm-4.5-air:free
- Viết code: poolside/laguna-m.1:free
- Làm Agent: openrouter/owl-alpha
- Làm rà soát phức tạp: nvidia/nemotron-3-super-120b-a12b:free
- Làm ngữ cảnh dài: deepseek/deepseek-v4-flash:free
Tám, Cách cấu hình gợi ý
Nếu bạn muốn tích hợp các mô hình này vào dự án của mình, có thể cấu hình theo mục đích:
TEXT_MODEL=z-ai/glm-4.5-air:free
CODING_MODEL=poolside/laguna-m.1:free
AGENT_MODEL=openrouter/owl-alpha
REVIEW_MODEL=nvidia/nemotron-3-super-120b-a12b:free
REASONING_MODEL=openai/gpt-oss-120b:free
LONG_CONTEXT_MODEL=deepseek/deepseek-v4-flash:free
FALLBACK_MODEL=openrouter/freeNếu bạn đang học cách xây dựng AI Agent, có thể tham khảo 《Hello Agents: Xây dựng AI Agent từ đầu》 để bắt đầu, rồi dùng các mô hình miễn phí này làm hạ tầng luyện tập. Nếu bạn đang làm AI Agent, có thể thiết lập một chiến lược dự phòng đơn giản:
Bước 1: Dùng Owl Alpha làm kế hoạch nhiệm vụ và test Agent ngữ cảnh dài
Bước 2: Dùng Laguna M.1 viết code
Bước 3: Dùng gpt-oss-120b làm suy luận cấu trúc và gọi công cụ
Bước 4: Dùng Nemotron 3 Super để rà soát code và phán đoán kiến trúc
Bước 5: Nếu bị giới hạn tần suất, chuyển sang DeepSeek V4 Flash, GLM 4.5 Air hoặc openrouter/freeCách này ổn định hơn việc chỉ phụ thuộc một mô hình miễn phí.
Chín, Lưu ý khi tận dụng miễn phí
1. Mô hình miễn phí thay đổi rất nhanh
Bài viết này đã loại bỏ phần khuyến nghị nhấn mạnh mô hình 1T trước đó, vì nó không còn phù hợp làm lõi khuyến nghị miễn phí hiện tại. Danh sách mô hình miễn phí sẽ đổi, khi viết cấu hình đừng bám vào bài cũ.
2. Đừng xem mô hình miễn phí là lực lượng chính của sản xuất
Mô hình miễn phí có thể thay đổi giá, giới hạn, nhà cung cấp hoặc tính khả dụng bất kỳ lúc nào. Học tập cá nhân thì ổn, còn sản phẩm chính thức cần chuẩn bị fallback trả phí.
3. Đừng đưa thông tin nhạy cảm vào mô hình miễn phí
Mô hình miễn phí phù hợp tài liệu công khai, dự án học tập, bài viết thông thường và code không nhạy cảm. Khi có dữ liệu riêng tư, thông tin khách hàng hoặc bí mật kinh doanh, đừng đưa bừa vào mô hình miễn phí.
4. Đừng chỉ nhìn vào kích thước tham số
Mô hình lớn chưa chắc hợp nhiệm vụ của bạn. Viết bài thì ưu tiên biểu đạt tiếng Trung, viết code thì ưu tiên năng lực code, làm Agent thì ưu tiên tính ổn định của gọi công cụ.
5. Đừng tin tưởng openrouter/free
openrouter/free tiện lợi, nhưng route mô hình không cố định. Với dự án chính thức, tốt hơn là khóa riêng ID mô hình.
6. Chi dùng hạn mức miễn phí một cách tiết kiệm
Người dùng miễn phí có giới hạn yêu cầu mỗi ngày, ngay cả request lỗi cũng có thể tiêu tốn hạn mức. Khi test Agent, dễ có tình trạng một nhiệm vụ kéo dài gọi nhiều lần, nên thêm cache, giới hạn số vòng tối đa và đặt fallback.
Mười, Kết luận
Giá trị của mô hình miễn phí OpenRouter rất lớn, đặc biệt phù hợp sinh viên, lập trình viên độc lập, người học AI Agent và người viết cho website cá nhân.
Đề xuất cuối cùng của tôi là:
- Xử lý văn bản: ưu tiên GLM 4.5 Air hoặc Gemma 4 31B
- Nhiệm vụ lập trình: ưu tiên Poolside Laguna M.1
- Suy luận Agent: ưu tiên Owl Alpha
- Rà soát phức tạp: dùng Nemotron 3 Super hoặc gpt-oss-120b
- Ngữ cảnh siêu dài: thử DeepSeek V4 Flash
Giá trị cốt lõi của mô hình miễn phí không phải là “tìm một mô hình mạnh nhất để dùng đến cùng”, mà là phân bổ theo nhiệm vụ: văn bản dùng mô hình văn bản, code dùng mô hình code, Agent dùng mô hình có năng lực suy luận và gọi công cụ tốt hơn. Chỉ khi đó mới tận dụng tối đa hạn mức miễn phí.
Câu hỏi thường gặp
OpenRouter là gì?
OpenRouter là nền tảng điều phối tổng hợp mô hình AI, gom truy cập từ OpenAI, Anthropic, Google, DeepSeek và nhiều nhà cung cấp khác để bạn chuyển đổi mô hình chỉ bằng một API Key. Một số mô hình có hạn mức miễn phí, phù hợp học tập và thử nghiệm chi phí thấp.
Mô hình miễn phí có giới hạn tần suất không?
Có. Hầu hết mô hình miễn phí của OpenRouter bị giới hạn theo số request mỗi phút (RPM) hoặc mỗi ngày (RPD). Mức cụ thể theo trang mô hình chính thức của OpenRouter. Khi gặp giới hạn, có thể chuyển sang mô hình dự phòng (ví dụ route openrouter/free tự chọn mô hình miễn phí đang tải thấp nhất).
Mô hình miễn phí có phù hợp cho môi trường sản xuất không?
Không khuyến nghị. Mô hình miễn phí có thể bị gỡ, giới hạn hoặc đổi nhà cung cấp bất kỳ lúc nào, nên ổn định không được đảm bảo. Chúng phù hợp cho học tập, test, dự án cá nhân và workflow nhẹ; sản xuất nên dùng mô hình trả phí và chuẩn bị chiến lược fallback.
Chọn mô hình miễn phí nào cho lập trình tốt nhất?
Hiện tại gợi ý Poolside Laguna M.1 (sinh code), gpt-oss-120b (suy luận cấu trúc hóa + tool calling), Nemotron 3 Super (rà soát code). Cụ thể chọn theo phân loại trong bài, kết hợp theo tình trạng trực tuyến thực tế của OpenRouter để điều chỉnh.
Liên kết tham khảo
- OpenRouter miễn phí tìm kiếm mô hình
- OpenRouter bộ sưu tập mô hình miễn phí
- OpenRouter Free Models Router
- OpenRouter API Rate Limits
- OpenRouter Pricing
- OpenRouter Owl Alpha
- NVIDIA Nemotron 3 Super 120B A12B Free
- Poolside Laguna M.1 Free
- OpenAI gpt-oss-120b Free
- DeepSeek V4 Flash Free
- MiniMax M2.5 Free
- Arcee AI Trinity Large Thinking Free
- Baidu Qianfan CoBuddy Free
Share