Từ năm 2025 đến 2026, định giá API AI đã trải qua một cuộc chiến giảm giá khốc liệt không kém gì các cuộc chiến thương mại điện tử.
Làn sóng giảm giá
Chiến lược chi phí thấp của DeepSeek đã tạo áp lực giảm giá lớn lên toàn ngành. Khi chi phí vận hành của R1 chỉ bằng 1/20 đến 1/50 so với các mô hình cùng cấp của OpenAI, logic định giá của các nhà cung cấp mã nguồn đóng đã bị lung lay trực tiếp.
Phản ứng của OpenAI là liên tục tung ra các phiên bản nhỏ hơn và rẻ hơn (Mini, Nano), đồng thời duy trì mức giá cao ở phân khúc cao cấp. Năm phiên bản của GPT-5.4 bao phủ toàn bộ dải giá từ vài đô la đến vài chục đô la.
Anthropic theo đuổi chiến lược phân tầng — Haiku rẻ và nhanh, Sonnet cân bằng, Opus đắt nhưng mạnh. Mức giá khởi điểm 20 đô la/tháng của Claude Code là trung bình trong số các sản phẩm cùng loại.
Tăng giá ngầm
Một số nhà cung cấp không tăng giá công khai, nhưng đã tăng giá ngầm thông qua giới hạn tốc độ, cắt giảm hạn mức miễn phí, điều chỉnh cách tính token. Nhiều nhà phát triển phản ánh rằng chi phí sử dụng API thực tế đã cao hơn so với một năm trước.
Vấn đề giới hạn tốc độ mà người dùng Claude Code phản ánh là một ví dụ điển hình — gói Max 100 đô la/tháng đôi khi chỉ một prompt đã dùng hết hạn mức. Bề ngoài phí hàng tháng không đổi, nhưng dung lượng khả dụng thực tế đang bị thắt chặt.
Xu hướng định giá
Một số nhận định:
- Khả năng hội thoại cơ bản sẽ tiếp tục giảm giá, tiến tới trở thành hàng hóa phổ thông
- Khả năng suy luận và khả năng tác nhân là điểm neo định giá mới
- Tính phí theo tác vụ (thay vì tính phí theo token) có thể trở thành xu hướng mới
- Các mô hình mã nguồn mở sẽ tiếp tục đẩy giảm không gian định giá của các mô hình mã nguồn đóng
Cục diện cuối cùng có thể là: khả năng mô hình cơ bản gần như miễn phí, các khả năng cao cấp (suy luận sâu, tác nhân, ngữ cảnh dài) tính phí theo nhu cầu. Giống như sự tiến hóa của điện toán đám mây năm xưa — tính toán cơ bản trở nên rẻ, dịch vụ cao cấp có giá cao.
Nguồn tham khảo: Trang định giá API của các công ty, CocoLoop, phân tích ngành