OpenAI Giảm Một Phần Ba Giá Đầu Ra API GPT-5.6 Sol Trong Chương Trình Khuyến mại Ba Tháng
OpenAI đã giảm giá đầu ra API GPT-5.6 Sol xuống còn $20 mỗi triệu token và đầu vào xuống $4 ít nhất đến ngày 21 tháng 11.
1. OpenAI hạ chi phí cho mô hình chủ lực của mình
OpenAI đã giảm giá API và tín dụng của GPT-5.6 Sol vào ngày 21 tháng 8 năm 2026, đưa ra mức giá khuyến mại mà công ty cho biết sẽ duy trì ít nhất đến ngày 21 tháng 11. Thay đổi lớn nhất là giá token đầu ra: đầu ra API tiêu chuẩn với ngữ cảnh ngắn hiện có giá $20 mỗi triệu token, giảm từ $30.
Giá đầu vào tiêu chuẩn giảm từ $5 xuống $4 mỗi triệu token. Đầu vào được lưu đệm giảm từ $0.50 xuống $0.40, trong khi ghi bộ nhớ đệm—được tính phí bằng 1.25 lần mức đầu vào không lưu đệm—giảm từ $6.25 xuống $5 mỗi triệu token.
| Mức sử dụng tiêu chuẩn với ngữ cảnh ngắn | Giá trước đó mỗi 1M token | Giá khuyến mại | Mức giảm |
|---|---|---|---|
| Đầu vào | $5.00 | $4.00 | 20% |
| Đầu vào được lưu đệm | $0.50 | $0.40 | 20% |
| Ghi bộ nhớ đệm | $6.25 | $5.00 | 20% |
| Đầu ra | $30.00 | $20.00 | 33.3% |
OpenAI mô tả mức giảm tổng thể là hơn 20%, nhưng khoản tiết kiệm của từng khối lượng công việc phụ thuộc vào tỷ lệ đầu vào so với đầu ra. Một yêu cầu sử dụng một triệu token đầu vào và tạo ra một triệu token đầu ra trước đây sẽ có giá $35 theo biểu giá cũ. Hiện nay, chi phí là $24, giảm khoảng 31.4%.
Các khối lượng công việc thiên về đầu ra nhận được lợi ích tỷ lệ phần trăm lớn nhất. Một triệu token đầu vào, tiếp theo là ba triệu token đầu ra, hiện có giá $64 thay vì $95, giảm khoảng 32.6%. Điều này quan trọng đối với các tác tử lập trình, hệ thống nghiên cứu và quy trình tạo nội dung dài, trong đó mô hình tạo ra lượng đáng kể suy luận, mã hoặc tài liệu.
Thay đổi này ảnh hưởng đến việc tính phí chứ không phải định danh mô hình. Nhà phát triển có thể tiếp tục dùng gpt-5.6-sol; bí danh gpt-5.6 vẫn định tuyến đến Sol. Tài liệu của OpenAI vẫn liệt kê cửa sổ ngữ cảnh 1.05 triệu token, đầu ra tối đa 128,000 token, đầu vào văn bản và hình ảnh, gọi hàm, đầu ra có cấu trúc và các công cụ gồm tìm kiếm web, tìm kiếm tệp, thực thi mã, sử dụng máy tính và MCP.
2. Tín dụng đã mua trở nên rẻ hơn, nhưng mức sử dụng đi kèm không tăng
Mức giảm cũng đang được áp dụng cho hoạt động sử dụng ChatGPT Work và Codex đủ điều kiện, được thanh toán bằng tín dụng đã mua. Biểu giá dựa trên tín dụng của OpenAI hiện tính 100 tín dụng mỗi triệu token đầu vào, 10 tín dụng mỗi triệu token đầu vào được lưu đệm và 500 tín dụng mỗi triệu token đầu ra đối với GPT-5.6 Sol.
Các mức này áp dụng cho hoạt động tác tử được hỗ trợ, bao gồm tác vụ cục bộ và đám mây, tự động hóa, worker được ủy quyền và các quy trình Codex đủ điều kiện. OpenAI cho biết một tác vụ Codex điển hình dùng Sol có thể tiêu thụ từ năm đến 30 tín dụng, dù lượng thực tế phụ thuộc vào khối lượng token, suy luận, độ phức tạp tác vụ, tự động hóa và việc có chọn xử lý nhanh hơn hay không.
Chương trình khuyến mại không làm tăng hạn mức đi kèm của gói thuê bao. OpenAI nêu rằng mức sử dụng đi kèm của gói, giới hạn năm giờ và hàng tuần, cùng các mức tín dụng cũ vẫn không đổi. Mức tín dụng ChatGPT thông thường cho một tin nhắn Sol cũng vẫn là 10 tín dụng, vì vậy chương trình này không nên được hiểu là hạn ngạch tin nhắn lớn hơn cho người đăng ký ChatGPT.
Với các ghế ChatGPT Business tiêu chuẩn, các giới hạn đi kèm được sử dụng trước khi hoạt động đủ điều kiện có thể rút từ nhóm tín dụng đã mua của workspace. Các ghế chỉ dùng Codex theo mô hình tính phí theo mức sử dụng cần tín dụng workspace ngay từ đầu. Biểu giá hiện tại cũng áp dụng cho khách hàng Enterprise, Edu, Health, Gov và ChatGPT for Teachers mới lẫn hiện hữu sử dụng cấu trúc định giá linh hoạt tương ứng.
Một nhóm nhỏ khách hàng Enterprise vẫn dùng biểu giá Codex cũ cho đến khi chuyển đổi. Các workspace này không tự động nhận cách tính tín dụng mới dựa trên token. Khách hàng có hợp đồng quy định thanh toán theo mức sử dụng bằng đô la Mỹ phải dùng biểu giá trong thỏa thuận của họ, thay vì giả định bảng tín dụng chung được áp dụng.
Sự khác biệt này giải thích vì sao OpenAI có thể giảm “giá tín dụng” nhưng vẫn nói rằng mức sử dụng thuê bao Pro, Plus và Business không thay đổi. Mức sử dụng đã mua, được đo theo token, có thể đi xa hơn; các giới hạn đi kèm của thuê bao hiện hữu không trở nên lớn hơn.
3. Ngữ cảnh dài và xử lý nhanh hơn vẫn có mức giá riêng
Mức giá tiêu đề $4 cho đầu vào và $20 cho đầu ra áp dụng cho xử lý Standard với không quá 272,000 token đầu vào. Khi prompt vượt ngưỡng đó, OpenAI áp dụng mức giá ngữ cảnh dài cho toàn bộ yêu cầu, không chỉ các token vượt quá 272,000.
Theo biểu giá khuyến mại, mức sử dụng Standard với ngữ cảnh dài có giá $8 mỗi triệu token đầu vào, $0.80 mỗi triệu token đầu vào được lưu đệm, $10 mỗi triệu token ghi bộ nhớ đệm và $30 mỗi triệu token đầu ra. Điều đó tương ứng với hệ số gấp hai lần đối với đầu vào và đầu vào được lưu đệm, và gấp 1.5 lần đối với đầu ra.
Tầng xử lý cũng làm thay đổi hóa đơn:
| Tầng GPT-5.6 Sol, ngữ cảnh ngắn | Đầu vào mỗi 1M token | Đầu vào được lưu đệm | Ghi bộ nhớ đệm | Đầu ra |
|---|---|---|---|---|
| Standard | $4.00 | $0.40 | $5.00 | $20.00 |
| Batch | $2.00 | $0.20 | $2.50 | $10.00 |
| Flex | $2.00 | $0.20 | $2.50 | $10.00 |
| Fast mode | $8.00 | $0.80 | $10.00 | $40.00 |
Do đó, Batch và Flex vẫn bằng một nửa giá Standard đối với các khối lượng công việc có thể chấp nhận đặc tính thực thi của chúng. Fast mode có giá gấp đôi mức Standard khuyến mại. OpenAI đã đổi tên Priority Processing thành Fast mode vào ngày 30 tháng 7, nhưng các yêu cầu dùng service_tier: "priority" vẫn tương thích.
Các endpoint xử lý theo khu vực đủ điều kiện có thêm phụ phí lưu trú dữ liệu 10%. OpenAI cũng cảnh báo rằng các mô hình được cung cấp qua Amazon Bedrock được AWS tính phí và có thể không khớp với biểu giá API trực tiếp của OpenAI.
Đối với các nhà phát triển ước tính khoản tiết kiệm, tầng xử lý, độ dài ngữ cảnh và hành vi bộ nhớ đệm có thể quan trọng hơn tỷ lệ phần trăm tiêu đề. Chẳng hạn, một yêu cầu Fast mode với ngữ cảnh dài được niêm yết ở mức $16 mỗi triệu token đầu vào và $60 mỗi triệu token đầu ra—lần lượt gấp bốn và ba lần mức Standard khuyến mại với ngữ cảnh ngắn.
4. Sol nối tiếp các đợt giảm giá Terra và Luna trước đó
Chương trình khuyến mại Sol là động thái định giá GPT-5.6 thứ hai của OpenAI trong chưa đầy một tháng. Vào ngày 30 tháng 7, công ty đã giảm giá GPT-5.6 Terra 20% và Luna 80%. Khi đó, Sol vẫn giữ mức giá khi ra mắt là $5 mỗi triệu token đầu vào và $30 mỗi triệu token đầu ra, trong khi OpenAI giới thiệu Fast mode với giá gấp đôi Standard và tốc độ nhanh hơn tới 2.5 lần.
OpenAI quy các thay đổi trước đó cho những cải tiến trên toàn bộ hệ thống suy luận và phần mềm sản xuất của mình. Công ty cho biết việc tối ưu hóa kernel với sự hỗ trợ của Sol đã giảm 20% chi phí phục vụ đầu cuối, trong khi các thử nghiệm liên quan đến tạo token cải thiện hiệu suất hơn 15%. Các con số này là kết quả kỹ thuật do công ty tự báo cáo, không phải cuộc kiểm toán độc lập về chi phí của OpenAI.
Reuters đặt mức giảm giá Sol mới trong bối cảnh cạnh tranh từ Anthropic và các nhà cung cấp mô hình Trung Quốc. Thay đổi cạnh tranh thực tế có thể đo lường mà không cần suy đoán về động cơ của OpenAI: Sol hiện rẻ hơn biểu giá công bố $5 đầu vào và $30 đầu ra của GPT-5.5, đồng thời vẫn giữ vị thế chủ lực của OpenAI trong dòng GPT-5.6.
Chương trình khuyến mại không xóa bỏ chênh lệch giá giữa ba tầng GPT-5.6. Với một khối lượng công việc đơn giản sử dụng một triệu token đầu vào và một triệu token đầu ra, giá Standard với ngữ cảnh ngắn tổng cộng là $24 cho Sol, $14 cho Terra và $1.40 cho Luna. Nhà phát triển vẫn cần đánh giá theo từng khối lượng công việc để quyết định khi nào năng lực cao hơn của Sol biện minh cho chi phí của nó.
OpenAI chỉ cam kết duy trì giá Sol khuyến mại ít nhất đến ngày 21 tháng 11. Công ty chưa cho biết liệu các mức giá này sẽ trở thành vĩnh viễn, được gia hạn hay quay về biểu giá trước đó. Vì vậy, các dự báo chi phí kéo dài sau ngày đó nên giữ mức giá cũ $5 đầu vào và $30 đầu ra làm kịch bản dự phòng.
Câu hỏi thường gặp
Giá API GPT-5.6 Sol mới là bao nhiêu?
Mức sử dụng Standard với ngữ cảnh ngắn có giá $4 mỗi triệu token đầu vào, $0.40 mỗi triệu token đầu vào được lưu đệm và $20 mỗi triệu token đầu ra.
Mức giá thấp hơn sẽ kéo dài bao lâu?
OpenAI cho biết giá khuyến mại sẽ được duy trì ít nhất đến ngày 21 tháng 11 năm 2026. Công ty chưa công bố điều gì sẽ thay thế mức giá này.
Các giới hạn thuê bao ChatGPT có tăng không?
Không. Mức sử dụng đi kèm của gói, giới hạn năm giờ và hàng tuần, cùng các mức tín dụng cũ vẫn không đổi. Mức giảm áp dụng cho hoạt động sử dụng API và hoạt động đủ điều kiện được thanh toán bằng tín dụng đã mua.
Nhà phát triển API có cần thay đổi ID mô hình không?
Không. Mô hình vẫn là gpt-5.6-sol, và bí danh gpt-5.6 tiếp tục định tuyến đến Sol.
Mức $4 cho đầu vào có áp dụng cho prompt trên 272,000 token không?
Không. Các yêu cầu vượt 272,000 token đầu vào bị tính mức giá ngữ cảnh dài cho toàn bộ yêu cầu, bao gồm $8 mỗi triệu token đầu vào và $30 mỗi triệu token đầu ra theo xử lý Standard.
Tham khảo nguồn
Share