Tin tức AISố chữ 6463Thời gian đọc17 phút

Hướng dẫn tận dụng mô hình miễn phí trên OpenRouter: gợi ý cho xử lý văn bản, lập trình và Agent

Dựa trên bộ sưu tập mô hình miễn phí của OpenRouter tháng 5 năm 2026, tôi tổng hợp lại các mô hình miễn phí phù hợp cho xử lý văn bản, lập trình, workflow Agent và thử nghiệm ngữ cảnh dài, đồng thời giải thích hạn mức miễn phí, giới hạn tần suất và chiến lược sử dụng.

OpenRouter thay đổi rất nhanh về danh sách mô hình miễn phí. Một số mô hình miễn phí nổi bật trước đây có thể đột ngột bị gỡ, chuyển nhà cung cấp, bị giới hạn tần suất, hoặc không còn xuất hiện trong bảng xếp hạng mô hình miễn phí nữa. Đặc biệt là các mô hình miễn phí quy mô 1T trước đây mà nhiều người chú ý, giờ không còn phù hợp để làm lựa chọn khuyến nghị chính.

Vì vậy bài viết này không còn viết kiểu “một mô hình nào đó luôn mạnh nhất”, mà thay vào đó sắp xếp theo mục đích sử dụng: xử lý văn bản, lập trình, workflow Agent, thử nghiệm ngữ cảnh dài với các mô hình chuyên dụng.

Trang mô hình miễn phí của OpenRouter: https://openrouter.ai/models?q=free

Bộ sưu tập mô hình miễn phí của OpenRouter: https://openrouter.ai/collections/free-models

Trang tổng hợp mô hình miễn phí chính thức của OpenRouter cho thấy thứ hạng hiện tại được cập nhật theo dữ liệu sử dụng thực tế của tháng 5 năm 2026. OpenRouter cũng ghi rõ rằng mô hình miễn phí chủ yếu dùng cho thử nghiệm, học tập và thử nghiệm chi phí thấp; không có gì đảm bảo rằng chúng sẽ tiếp tục được cung cấp trong tương lai. Vì vậy, mô hình miễn phí phù hợp cho học tập, test, dự án cá nhân và workflow nhẹ, không nên dùng làm engine sản xuất dài hạn duy nhất.

Các tài liệu tham khảo chính: OpenRouter Free Models, OpenRouter Free Models Router, OpenRouter API Rate Limits, OpenRouter Pricing

Một, Nói ngắn gọn: bây giờ nên chọn mô hình miễn phí như thế nào?

Nếu bạn chỉ cần nhanh chóng tận dụng miễn phí, có thể nhớ sẵn tổ hợp này:

Xử lý văn bản: GLM 4.5 Air / Gemma 4 31B / gpt-oss-120b
Nhiệm vụ lập trình: Poolside Laguna M.1 / gpt-oss-120b / DeepSeek V4 Flash
Workflow Agent: Owl Alpha / Nemotron 3 Super / MiniMax M2.5
Rà soát phức tạp: Nemotron 3 Super / gpt-oss-120b / Trinity Large Thinking
Thử nghiệm ngữ cảnh dài: Owl Alpha / Nemotron 3 Super / DeepSeek V4 Flash
Dự phòng tổng quát: openrouter/free

Đề xuất của tôi là: đừng dồn vào một mô hình miễn phí duy nhất. Cốt lõi của miễn phí là “đa mô hình phân công + dự phòng”. Dùng mô hình văn bản cho viết/chỉnh sửa văn bản, mô hình coding cho code, mô hình Agent cho nhiệm vụ cần gọi công cụ và ngữ cảnh dài. Cách này ổn định hơn nhiều so với việc bám một mô hình duy nhất.

Hai, Các mô hình miễn phí hiện tại đáng ưu tiên theo dõi

Theo bộ sưu tập mô hình miễn phí hiện tại của OpenRouter, dưới đây là các mô hình đáng ưu tiên thử:

Mức ưu tiênMã mô hìnhỨng dụng phù hợpNhận xét
Sopenrouter/owl-alphaAgent, ngữ cảnh dài, workflow tự động hóaMô hình đứng đầu trong bảng miễn phí hiện tại, ngữ cảnh 1M, phù hợp thử nghiệm cho các công cụ sản xuất như Claude Code / OpenClaw
Snvidia/nemotron-3-super-120b-a12b:freeSuy luận phức tạp, rà soát code, đa AgentKiến trúc MoE 120B, ngữ cảnh 1M, phù hợp lập kế hoạch phức tạp, phân tích tài liệu dài và suy luận chéo tài liệu
S-poolside/laguna-m.1:freeLập trình, Coding AgentHướng tới nhiệm vụ kỹ thuật phần mềm phức tạp, hỗ trợ tool calling và reasoning, phù hợp sinh mã và gọi công cụ
A+openai/gpt-oss-120b:freeSuy luận, gọi công cụ, đầu ra cấu trúc hóaMô hình MoE mã nguồn mở của OpenAI, phù hợp suy luận tổng quát, thử nghiệm Agent và rà soát code
A+deepseek/deepseek-v4-flash:freeNgữ cảnh dài, code, AgentNgữ cảnh 1M, phù hợp phản hồi nhanh, xử lý tác vụ ngữ cảnh dài và coding assistant
Az-ai/glm-4.5-air:freeTiếng Trung, hỏi đáp tổng quát, Agent nhẹTrải nghiệm tiếng Trung tốt, hỗ trợ chế độ thinking / non-thinking, phù hợp văn bản và suy luận nhẹ
Aminimax/minimax-m2.5:freeTự động hóa văn phòng, Agent, codeHướng tới nhiệm vụ sản xuất thực tế, phù hợp Word, Excel, PPT, code và workflow đa phần mềm
A-poolside/laguna-xs-2:freeLập trình nhẹ, Coding AgentThay thế nhẹ hơn cho Laguna M.1, phù hợp dự phòng cho code
A-arcee-ai/trinity-large-thinking:freeSuy luận, Agent, rà soát phức tạpMô hình reasoning mã nguồn mở, phù hợp thí nghiệm workflow Agent giữ reasoning
B+baidu/cobuddy:freeSinh code, AI AgentMô hình code của Baidu, hỗ trợ tool calling và reasoning, phù hợp code nhẹ và giải thích code tiếng Trung
B+openai/gpt-oss-20b:freeSuy luận nhẹ, đầu ra cấu trúc hóaNhẹ hơn 120B, phù hợp độ trễ thấp và tác vụ cấu trúc hóa phổ thông
Bnvidia/nemotron-3-nano-30b-a3b:freeAgent nhẹ, nghiên cứu private AIMoE nhẹ, phù hợp thử nghiệm hệ thống agentic chuyên biệt
Bopenrouter/freeKiểm tra thử miễn phíTự động chọn mô hình miễn phí, tiện lợi nhưng chưa ổn định, không nên dùng cho debug chính thức

Lưu ý: danh sách mô hình miễn phí thay đổi liên tục. Trước khi dùng thật, nên mở trang mô hình để xác nhận xem nó còn miễn phí không, có hỗ trợ tool calling không, độ dài ngữ cảnh bao nhiêu, và có giới hạn nhà cung cấp hay không.

Ba, Khuyến nghị mô hình miễn phí cho xử lý văn bản

Xử lý văn bản gồm biên tập bài tiếng Trung, tóm tắt, dịch, sắp xếp tài liệu dài, tổ chức knowledge base, viết email, tái diễn giải hướng dẫn kỹ thuật,…

Ưu tiên cho mô hình văn bản

Mức ưu tiênMã mô hìnhỨng dụng phù hợpNhận xét
Sz-ai/glm-4.5-air:freeHỏi đáp tiếng Trung, biên tập bài, suy luận nhẹTrải nghiệm tiếng Trung tốt, phù hợp làm mô hình văn bản chính hàng ngày
S-google/gemma-4-31b-it:freeVăn bản đa ngôn ngữ, hiểu tài liệu, viết thông thườngỔn định, tổng quát, phù hợp xử lý văn bản cơ bản và tác vụ đa ngôn ngữ
A+openai/gpt-oss-120b:freeViết lại có cấu trúc, tóm tắt phức tạp, hệ thống hóa ýSức mạnh suy luận tốt, phù hợp rà soát văn bản phức tạp và tái cấu trúc logic
Anvidia/nemotron-3-super-120b-a12b:freeTài liệu dài, phân tích văn bản phức tạpPhù hợp phân tích khối nội dung lớn, nhưng không phải lúc nào cũng tối ưu cho biên tập nhẹ tần suất cao
A-deepseek/deepseek-v4-flash:freeTổ chức với ngữ cảnh dài, tóm tắt nhanhPhù hợp kịch bản cần nạp nội dung dài, log hoặc tài liệu dày
B+openrouter/freeChat nhanh, test nhanhTiện lợi nhưng route không cố định

Tổ hợp ưu tiên cho xử lý văn bản

Nếu bạn chỉ viết blog, chỉnh sửa bài, làm tóm tắt, không nhất thiết phải mở ngay mô hình lớn nhất. Bài tiếng Trung thông thường có thể thử trước z-ai/glm-4.5-air:free hoặc google/gemma-4-31b-it:free. Nếu cần rà soát luận điểm phức tạp, tái cấu trúc bài dài hoặc phân tích logic, chuyển sang openai/gpt-oss-120b:free hoặc nvidia/nemotron-3-super-120b-a12b:free.

Bốn, Khuyến nghị mô hình miễn phí cho lập trình

Tác vụ lập trình gồm viết Python, giải thích lỗi, sửa bug, sinh script, đọc kho mã, rà soát code, hỗ trợ phát triển AI Agent,…

Ưu tiên cho mô hình lập trình

Mức ưu tiênMã mô hìnhỨng dụng phù hợpNhận xét
Spoolside/laguna-m.1:freeCoding Agent, phần mềm phức tạpHướng tới nhiệm vụ kỹ thuật phần mềm phức tạp, phù hợp sinh mã, gọi công cụ và workflow coding agentic
S-openai/gpt-oss-120b:freeSuy luận code, đầu ra cấu trúc hóa, gọi công cụPhù hợp giải thích code, rà soát code và thử nghiệm Agent
A+deepseek/deepseek-v4-flash:freeCode ngữ cảnh dài, sửa nhanhPhù hợp code dài, phản hồi nhanh và coding assistant
Apoolside/laguna-xs-2:freeCode nhẹ, Agent chi phí thấpPhù hợp thay thế M.1 làm dự phòng
Abaidu/cobuddy:freeSinh code, giải thích code tiếng TrungPhù hợp task code nhẹ, đặc biệt giải thích tiếng Trung và thử nghiệm gọi công cụ
A-minimax/minimax-m2.5:freeNhiệm vụ kỹ thuật, tự động hóa văn phòng, AgentPhù hợp tình huống tăng năng suất thực tế, không chỉ giới hạn trong code
B+nvidia/nemotron-3-super-120b-a12b:freeRà soát code, phân tích kiến trúcPhù hợp cố vấn cao cấp, không nên để nó tự động sửa toàn kho mã không giám sát

Tổ hợp ưu tiên cho lập trình

Nếu bạn làm dự án gọi công cụ như Claude Code, Cline, Roo Code, OpenCode, đừng chỉ nhìn khả năng chat. Quan trọng hơn là:

1. Có hỗ trợ tool calling không; 2. Có thể ổn định đầu ra dạng có cấu trúc không; 3. Có hiểu ngữ cảnh dài không; 4. Có thể thực thi theo từng bước theo nhiệm vụ không; 5. Có dễ sửa file lung tung không.

Thứ tự của tôi là: poolside/laguna-m.1:free phụ trách sinh code, openai/gpt-oss-120b:free phụ trách suy luận và đầu ra cấu trúc hóa, nvidia/nemotron-3-super-120b-a12b:free phụ trách rà soát phức tạp và phán đoán kiến trúc.

Năm, Khuyến nghị mô hình miễn phí cho Agent / gọi công cụ

Mô hình Agent không phải là mô hình chat đơn thuần. Nó cần đọc yêu cầu, tách bước, gọi công cụ, đọc kết quả gọi công cụ, tiếp tục suy luận, và càng ít sai định dạng càng tốt.

Ưu tiên mô hình Agent

Mức ưu tiênMã mô hìnhỨng dụng phù hợpNhận xét
Sopenrouter/owl-alphaAgent, ngữ cảnh dài, workflow tự động hóaMô hình đầu bảng miễn phí hiện tại, phù hợp thử nghiệm công cụ như Claude Code / OpenClaw
Snvidia/nemotron-3-super-120b-a12b:freeNhiều Agent, lập kế hoạch phức tạp, ngữ cảnh dàiNgữ cảnh 1M, phù hợp lập kế hoạch tác vụ dài hạn, suy luận chéo tài liệu và nhiều bước
S-minimax/minimax-m2.5:freeTự động hóa văn phòng, Agent, workflow đa phần mềmHướng tới môi trường năng suất thực tế, phù hợp tư duy Agent văn phòng
A+openai/gpt-oss-120b:freeTool calling, đầu ra cấu trúc hóa, suy luậnPhù hợp thử nghiệm framework Agent
A+poolside/laguna-m.1:freeCoding AgentPhù hợp Agent về code
Adeepseek/deepseek-v4-flash:freeAgent ngữ cảnh dài, phản hồi nhanhPhù hợp tác vụ thông lượng cao và ngữ cảnh dài
A-arcee-ai/trinity-large-thinking:freereasoning Agent, nhiệm vụ phức tạpPhù hợp thử nghiệm workflow Agent giữ lại reasoning
B+z-ai/glm-4.5-air:freeAgent nhẹ, tác vụ tiếng TrungPhù hợp dự phòng tổng quát
Bopenrouter/freeRoute miễn phí tạm thờiTiện nhưng không kiểm soát được, không phù hợp debug chính thức

OpenRouter còn có một route đặc biệt: openrouter/free.

Nó sẽ tự động chọn mô hình miễn phí có sẵn, thích hợp cho chat tạm và test nhanh. Nhưng nếu bạn đang viết framework Agent riêng, không nên dùng openrouter/free lâu dài, vì mỗi lần định tuyến có thể tới mô hình khác nhau, hành vi không ổn định khiến debug rất đau đầu.

Sáu, Nhận xét nhanh các mô hình trọng điểm

1. openrouter/owl-alpha

Trang mô hình: OpenRouter Owl Alpha

OpenRouter mô tả Owl Alpha là một mô hình đáng chú ý trong bảng miễn phí hiện tại. Trang của họ nhấn mạnh tới agentic workloads, tool use, long-context tasks, code generation, automated workflows và complex instruction execution, đồng thời ghi rõ tương thích với các công cụ sản xuất như Claude Code và OpenClaw.

Định vị của tôi:

Phù hợp: Agent, ngữ cảnh dài, workflow tự động hóa, thử nghiệm công cụ kiểu Claude Code
Không phù hợp: Môi trường sản xuất có yêu cầu ổn định cực cao

Nó rất phù hợp để test AgentLab, CLI kiểu Claude Code, lập kế hoạch tác vụ nhiều bước. Nhưng bản chất “alpha”, nên độ ổn định thực tế và phong cách đầu ra cần tự test.

2. nvidia/nemotron-3-super-120b-a12b:free

Trang mô hình: NVIDIA Nemotron 3 Super 120B A12B Free

NVIDIA Nemotron 3 Super là mô hình MoE 120B tham số, mỗi lần kích hoạt khoảng 12B tham số. OpenRouter hiện mô tả nó hỗ trợ ngữ cảnh 1M token, hướng tới long-term agent coherence, cross-document reasoning và multi-step task planning.

Định vị của tôi:

Phù hợp: Suy luận phức tạp, phân tích tài liệu dài, rà soát code, lập kế hoạch Agent
Không phù hợp: Tự động nắm quyền toàn bộ dự án mà không giám sát

Nó phù hợp làm “cố vấn cao cấp”: rà soát code, giải thích kiến trúc, lập kế hoạch tác vụ, phân tích văn bản dài. Nhưng nếu cắm trực tiếp vào công cụ tự viết code, nên thử quy mô nhỏ trước để tránh sửa file bừa hoặc đầu ra không ổn định.

3. poolside/laguna-m.1:free

Trang mô hình: Poolside Laguna M.1 Free

Laguna M.1 là mô hình coding agent của Poolside. Trang OpenRouter mô tả nó hướng tới nhiệm vụ phần mềm phức tạp, hỗ trợ tool calling và reasoning, phù hợp agentic coding workflows.

Định vị của tôi:

Phù hợp: Sinh code, giải thích code, Coding Agent, gọi công cụ
Không phù hợp: Viết văn bản dài tiếng Trung, chưa tự nhiên như mô hình văn bản tổng quát

Nếu bạn chỉ muốn chọn một mô hình code miễn phí, hãy ưu tiên thử cái này trước.

4. openai/gpt-oss-120b:free

Trang mô hình: OpenAI gpt-oss-120b Free

gpt-oss-120b là mô hình MoE mã nguồn mở của OpenAI. OpenRouter mô tả nó phù hợp cho high-reasoning, agentic và general-purpose use cases, và hỗ trợ native tool use, function calling, browsing và tạo đầu ra cấu trúc hóa.

Định vị của tôi:

Phù hợp: Suy luận phức tạp, đầu ra cấu trúc hóa, gọi công cụ, rà soát code
Không phù hợp: Thay thế một cách “chay” mọi mô hình trả phí

Nó phù hợp làm “tầng suy luận” hoặc “tầng rà soát” trong framework Agent. Nếu bạn thử nghiệm gọi công cụ, nó đáng thử hơn nhiều so với mô hình chat thông thường.

5. deepseek/deepseek-v4-flash:free

Trang mô hình: DeepSeek V4 Flash Free

DeepSeek V4 Flash là mô hình MoE tối ưu hiệu năng. Trang OpenRouter hiện tại ghi nó hỗ trợ cửa sổ ngữ cảnh 1M token, phù hợp coding assistants, chat systems và agent workflows.

Định vị của tôi:

Phù hợp: Ngữ cảnh dài, phản hồi nhanh, trợ lý code, workflow Agent
Không phù hợp: Viết tiếng Trung cần cảm giác ngôn ngữ cao

Điểm mạnh của nó là ngữ cảnh dài và hiệu năng. Nếu bạn cần nạp rất nhiều file, rất nhiều log, rất nhiều mô tả dự án thì đáng để test.

6. minimax/minimax-m2.5:free

Trang mô hình: MiniMax M2.5 Free

MiniMax M2.5 hướng tới năng suất thực tế (real-world productivity). Trang OpenRouter nói tới các môi trường Office như Word, Excel, PowerPoint và cũng nhấn mạnh coding expertise cùng planning.

Định vị của tôi:

Phù hợp: Tự động hóa văn phòng, xử lý tài liệu, tác vụ bảng tính, Agent năng suất
Không phù hợp: Lãng phí hạn mức cho việc chat tán gẫu

Nếu bạn nghiên cứu “AI giúp mình xử lý việc văn phòng thật”, mô hình này đáng được test riêng.

7. arcee-ai/trinity-large-thinking:free

Trang mô hình: Arcee AI Trinity Large Thinking Free

Trinity Large Thinking là mô hình reasoning mã nguồn mở của Arcee AI. Trang OpenRouter nhấn mạnh mô hình này phù hợp cho agentic workloads và reasoning tasks, và gợi ý các mô hình này nên giữ nguyên quá trình reasoning.

Định vị của tôi:

Phù hợp: Suy luận phức tạp, tách nhiệm vụ Agent, tác vụ rà soát
Không phù hợp: Chat tán gẫu độ trễ thấp và chỉnh sửa văn bản ngắn thông thường

Nó có thể là phương án dự phòng reasoning bên cạnh gpt-oss-120b:freenvidia/nemotron-3-super-120b-a12b:free.

Bảy, Thứ tự ưu tiên miễn phí cuối cùng của tôi

Bảng tổng hợp miễn phí

HạngMã mô hìnhỨng dụng chínhLý do đề xuất
1openrouter/owl-alphaAgent, ngữ cảnh dàiĐứng đầu bảng miễn phí hiện tại, ngữ cảnh 1M, phù hợp thử nghiệm workflow tự động hóa
2poolside/laguna-m.1:freeLập trình, Coding AgentƯu tiên test trước cho tác vụ code
3nvidia/nemotron-3-super-120b-a12b:freeSuy luận phức tạp, rà soát codeNgữ cảnh 1M, phù hợp phân tích phức tạp và suy luận chéo tài liệu
4openai/gpt-oss-120b:freeSuy luận, gọi công cụPhù hợp đầu ra cấu trúc hóa và test Agent
5deepseek/deepseek-v4-flash:freeNgữ cảnh dài, phản hồi nhanhNgữ cảnh 1M, phù hợp nhiệm vụ dài
6minimax/minimax-m2.5:freeAgent văn phòng, tác vụ năng suấtPhù hợp workflow tài liệu, bảng tính, PPT
7z-ai/glm-4.5-air:freeMở rộng tiếng Trung, suy luận nhẹMô hình dự phòng tiếng Trung, phù hợp biên tập bài và hỏi đáp thông thường
8google/gemma-4-31b-it:freeVăn bản, đa ngôn ngữ, hiểu tài liệuDự phòng xử lý văn bản hàng ngày
9arcee-ai/trinity-large-thinking:freereasoning, rà soát AgentDự phòng cho suy luận phức tạp
10baidu/cobuddy:freeCode nhẹ, giải thích code tiếng TrungDự phòng code
11openrouter/freeTest tạm thờiRoute tự động tiện lợi, nhưng không ổn định

Nếu bạn chỉ muốn nhớ 5 mô hình

Tám, Cách cấu hình gợi ý

Nếu bạn muốn tích hợp các mô hình này vào dự án của mình, có thể cấu hình theo mục đích:

TEXT_MODEL=z-ai/glm-4.5-air:free
CODING_MODEL=poolside/laguna-m.1:free
AGENT_MODEL=openrouter/owl-alpha
REVIEW_MODEL=nvidia/nemotron-3-super-120b-a12b:free
REASONING_MODEL=openai/gpt-oss-120b:free
LONG_CONTEXT_MODEL=deepseek/deepseek-v4-flash:free
FALLBACK_MODEL=openrouter/free

Nếu bạn đang học cách xây dựng AI Agent, có thể tham khảo 《Hello Agents: Xây dựng AI Agent từ đầu》 để bắt đầu, rồi dùng các mô hình miễn phí này làm hạ tầng luyện tập. Nếu bạn đang làm AI Agent, có thể thiết lập một chiến lược dự phòng đơn giản:

Bước 1: Dùng Owl Alpha làm kế hoạch nhiệm vụ và test Agent ngữ cảnh dài
Bước 2: Dùng Laguna M.1 viết code
Bước 3: Dùng gpt-oss-120b làm suy luận cấu trúc và gọi công cụ
Bước 4: Dùng Nemotron 3 Super để rà soát code và phán đoán kiến trúc
Bước 5: Nếu bị giới hạn tần suất, chuyển sang DeepSeek V4 Flash, GLM 4.5 Air hoặc openrouter/free

Cách này ổn định hơn việc chỉ phụ thuộc một mô hình miễn phí.

Chín, Lưu ý khi tận dụng miễn phí

1. Mô hình miễn phí thay đổi rất nhanh

Bài viết này đã loại bỏ phần khuyến nghị nhấn mạnh mô hình 1T trước đó, vì nó không còn phù hợp làm lõi khuyến nghị miễn phí hiện tại. Danh sách mô hình miễn phí sẽ đổi, khi viết cấu hình đừng bám vào bài cũ.

2. Đừng xem mô hình miễn phí là lực lượng chính của sản xuất

Mô hình miễn phí có thể thay đổi giá, giới hạn, nhà cung cấp hoặc tính khả dụng bất kỳ lúc nào. Học tập cá nhân thì ổn, còn sản phẩm chính thức cần chuẩn bị fallback trả phí.

3. Đừng đưa thông tin nhạy cảm vào mô hình miễn phí

Mô hình miễn phí phù hợp tài liệu công khai, dự án học tập, bài viết thông thường và code không nhạy cảm. Khi có dữ liệu riêng tư, thông tin khách hàng hoặc bí mật kinh doanh, đừng đưa bừa vào mô hình miễn phí.

4. Đừng chỉ nhìn vào kích thước tham số

Mô hình lớn chưa chắc hợp nhiệm vụ của bạn. Viết bài thì ưu tiên biểu đạt tiếng Trung, viết code thì ưu tiên năng lực code, làm Agent thì ưu tiên tính ổn định của gọi công cụ.

5. Đừng tin tưởng openrouter/free

openrouter/free tiện lợi, nhưng route mô hình không cố định. Với dự án chính thức, tốt hơn là khóa riêng ID mô hình.

6. Chi dùng hạn mức miễn phí một cách tiết kiệm

Người dùng miễn phí có giới hạn yêu cầu mỗi ngày, ngay cả request lỗi cũng có thể tiêu tốn hạn mức. Khi test Agent, dễ có tình trạng một nhiệm vụ kéo dài gọi nhiều lần, nên thêm cache, giới hạn số vòng tối đa và đặt fallback.

Mười, Kết luận

Giá trị của mô hình miễn phí OpenRouter rất lớn, đặc biệt phù hợp sinh viên, lập trình viên độc lập, người học AI Agent và người viết cho website cá nhân.

Đề xuất cuối cùng của tôi là:

Giá trị cốt lõi của mô hình miễn phí không phải là “tìm một mô hình mạnh nhất để dùng đến cùng”, mà là phân bổ theo nhiệm vụ: văn bản dùng mô hình văn bản, code dùng mô hình code, Agent dùng mô hình có năng lực suy luận và gọi công cụ tốt hơn. Chỉ khi đó mới tận dụng tối đa hạn mức miễn phí.

Câu hỏi thường gặp

OpenRouter là gì?

OpenRouter là nền tảng điều phối tổng hợp mô hình AI, gom truy cập từ OpenAI, Anthropic, Google, DeepSeek và nhiều nhà cung cấp khác để bạn chuyển đổi mô hình chỉ bằng một API Key. Một số mô hình có hạn mức miễn phí, phù hợp học tập và thử nghiệm chi phí thấp.

Mô hình miễn phí có giới hạn tần suất không?

Có. Hầu hết mô hình miễn phí của OpenRouter bị giới hạn theo số request mỗi phút (RPM) hoặc mỗi ngày (RPD). Mức cụ thể theo trang mô hình chính thức của OpenRouter. Khi gặp giới hạn, có thể chuyển sang mô hình dự phòng (ví dụ route openrouter/free tự chọn mô hình miễn phí đang tải thấp nhất).

Mô hình miễn phí có phù hợp cho môi trường sản xuất không?

Không khuyến nghị. Mô hình miễn phí có thể bị gỡ, giới hạn hoặc đổi nhà cung cấp bất kỳ lúc nào, nên ổn định không được đảm bảo. Chúng phù hợp cho học tập, test, dự án cá nhân và workflow nhẹ; sản xuất nên dùng mô hình trả phí và chuẩn bị chiến lược fallback.

Chọn mô hình miễn phí nào cho lập trình tốt nhất?

Hiện tại gợi ý Poolside Laguna M.1 (sinh code), gpt-oss-120b (suy luận cấu trúc hóa + tool calling), Nemotron 3 Super (rà soát code). Cụ thể chọn theo phân loại trong bài, kết hợp theo tình trạng trực tuyến thực tế của OpenRouter để điều chỉnh.

Liên kết tham khảo

Share

Chia sẻ bài viết