Vì sao Fable 5 — model đắt nhất Anthropic — ít người dùng nhất

Trong menu model của Anthropic, Fable 5 là lựa chọn đắt nhất: $10 cho mỗi triệu token đầu vào, $50 cho đầu ra — gấp đôi Opus 5. Nhưng theo dữ liệu chi tiêu tháng 7 của Ramp, Fable 5 chỉ chiếm 8% tổng chi tiêu cho model của Anthropic, thua xa Opus 4.8 — một model đã qua một thế hệ — với 28%.
Ngày 23/8, Financial Times đăng bài "Anthropic's best AI model struggles to attract users as cheaper tools thrive", nhanh chóng lên trang đầu Hacker News với 482 điểm. Bài viết phác một nghịch lý. Doanh thu của Anthropic vẫn tăng — khoảng 65 tỷ USD annualized trong tháng 7, theo nguồn tin, so với 47 tỷ hồi tháng 5. Nhưng chính model mạnh nhất, đắt nhất của họ lại là phân khúc yếu nhất.
Con số biết nói: frontier model chỉ còn 8%
Chỉ số Ramp AI index tổng hợp dữ liệu thanh toán từ khoảng 70.000 công ty, cho thấy phân bổ chi tiêu cho model của Anthropic trong tháng 7:
| Model | Tỷ trọng chi tiêu (7/2026) |
|---|---|
| Opus 4.8 | 28.0% |
| Sonnet 4.6 | 8.3% |
| Fable 5 | 8.0% |
| Opus 4.6 | 6.9% |
| Sonnet 5 | 3.6% |
| Opus 5 | 3.5% |
Hai điều nhảy ra khỏi bảng. Thứ nhất, frontier model Fable 5 — thứ mà Anthropic định vị là đỉnh cao — chỉ ngang bằng Sonnet 4.6 về chi tiêu thực tế. Thứ hai, Opus 4.8, model ra mắt trước đó, vẫn chiếm gần một phần ba. Cần lưu ý Opus 5 chỉ ra mắt ngày 24/7, nên số 3.5% là của hơn một tuần, không phải cả tháng. Việc nó vượt Fable 5 về chi tiêu doanh nghiệp chỉ trong hơn một tuần càng cho thấy xu hướng đó rõ hơn.
Vì sao đắt nhất lại ít được chọn
Lý do không nằm ở chất lượng. Fable 5 vẫn là model mạnh nhất của Anthropic trên nhiều benchmark, và chính system card của họ thừa nhận Opus 5 "không mạnh hơn Fable 5 về tổng thể". Vấn đề nằm ở phép tính kinh tế.
Một model mạnh hơn 3% trên một benchmark nhưng đắt gấp đôi trong production phải tự chứng minh rằng 3% đó đáng tiền trong công việc thật. Với đa số tác vụ — autocomplete, tóm tắt, trả lời support, sinh test — thì không. Opus 5 ra đời đúng vào điểm đó: "hiệu năng tiệm cận Fable 5 với giá chỉ bằng một nửa", theo cách Anthropic tự định vị, và được thiết kế để "dùng mỗi ngày".
Áp lực còn đến từ bên ngoài. GPT-5.6 Luna của OpenAI hiện ở mức $0.04/$0.24 mỗi triệu token sau đợt giảm giá cuối tháng 7, còn DeepSeek và Kimi K3 bán model gần tương đương với giá thấp hơn một bậc. Khi sàn giá bị kéo xuống liên tục, mức giá $10/$50 ngày càng khó biện minh cho bất kỳ ai không chạy tác vụ thật sự khó.
Anthropic tự quản lý sự khan hiếm
Phản ứng của Anthropic cho thấy họ hiểu vấn đề. Từ 20/7, trong các gói subscription, Fable 5 bị giới hạn ở 50% hạn mức dùng hàng tuần với gói Max và Team cao cấp, còn người dùng Pro và Team thường phải dùng qua credit riêng. Fable 5 không có hạn mức riêng — nó rút chung từ cùng một quỹ token hàng tuần, nghĩa là dùng Fable thì hết hạn nhanh hơn.
Cùng lúc, Opus 5 được trang bị một "núm vặn" chi phí: tham số effort với năm mức từ low đến max, cho khách hàng chọn model suy nghĩ bao lâu trước khi trả lời. Đó là cách Anthropic bán sự kiểm soát hóa đơn ngay trong sản phẩm — thừa nhận rằng với nhiều đội, dự đoán được chi phí quan trọng hơn vài điểm benchmark.
Điều cần biết
Đây không phải chuyện "Anthropic thua". Doanh thu của họ vẫn đang tăng, và họ kỳ vọng có lãi trong quý 3 theo cùng mô hình đã dùng để công bố quý 2 có lãi. Cái đang thay đổi là định nghĩa của "tốt nhất": từ "điểm benchmark cao nhất" sang "đáng tiền nhất cho mỗi tác vụ".
- Chọn model là bài toán danh mục, không phải bài toán một model. Mặc định dùng model rẻ nhất đủ đạt ngưỡng chất lượng của tác vụ; chỉ gọi frontier model cho 10-20% tác vụ thật sự khó, nơi chênh lệch đó trả tiền cho chính nó.
- Benchmark margin không phải ROI. Một model dẫn đầu SWE-bench 97% so với 95% không có nghĩa là đáng trả gấp đôi cho toàn bộ pipeline. Đo trên chính dữ liệu của bạn.
- Theo dõi chi tiêu, không chỉ chất lượng. Cách Anthropic thêm núm effort và ration Fable là tín hiệu: nhà cung cấp đang chuyển chi phí biên của frontier tier sang cho người dùng cuối. Đội nào không đo price-per-task sẽ trả nhiều hơn mức cần.
- Sàn giá còn xuống nữa. OpenAI giảm 80% giá Luna chỉ ba tuần sau khi ra mắt; Opus 5 đã rẻ bằng một phần ba Opus 4.1. Khóa chặt vào một model đắt sẽ khiến chi phí của bạn trở nên đắt tương đối theo từng quý.
Câu chuyện Fable 5 không phải là một sản phẩm thất bại. Nó là dấu hiệu cho thấy phân khúc cao cấp của AI đang bị ép từ hai phía. Model rẻ bên dưới đủ tốt cho phần lớn việc, còn chính nhà cung cấp phải tự kiểm soát mức tiêu thụ của model đắt nhất. Với developer, hệ quả đơn giản hơn nhiều người nghĩ: model tốt nhất không còn là model mạnh nhất — mà là model đáng tiền nhất cho đúng việc đang làm.
Bài viết được hỗ trợ bởi AI (Amy 🌸). Nội dung đã được kiểm duyệt bởi tác giả.
Related Posts
Claude Opus 5 Ra Mắt: Tiệm Cận Fable 5, Chi Phí Chỉ 50%
Anthropic ra mắt Claude Opus 5: #1 SWE-bench 97%, tiệm cận Fable 5 với giá chỉ bằng nửa. Cùng mức giá Opus 4.8, mạnh gấp đôi Frontier-Bench.
AI Mạnh Hơn, Tool Call Tệ Hơn: Nghịch Lý Claude Opus 4.8 & Sonnet 5
Opus 4.8 và Sonnet 5 gọi edit tool hỏng 20% số lần — trong khi model cũ không bị. Armin Ronacher phân tích nguyên nhân.
Claude Sonnet 5 Ra Mắt: Tiệm Cận Opus 4.8 Với Chi Phí Thấp Hơn
Anthropic ra mắt Claude Sonnet 5 ngày 30/6/2026 — model Sonnet agentic nhất từ trước đến nay, hiệu năng gần Opus 4.8 nhưng giá chỉ bằng một phần nhỏ.