Hai công cụ AI coding mà phần lớn team kỹ thuật dùng hàng ngày vừa âm thầm trở nên đắt hơn hôm nay. Không phải vì một đợt tăng giá rầm rộ — mà vì giá ưu đãi ra mắt và giá khuyến mãi đơn giản là hết hạn đúng lịch. Nếu bạn lập ngân sách hồi tháng 6 hay tháng 7 dựa trên giá lúc ra mắt, thì ngân sách đó sai kể từ sáng nay.

Chuyện Gì Vừa Xảy Ra Hôm Nay

Claude Sonnet 5 ra mắt ngày 30/6/2026 với giá API ưu đãi 2 USD/triệu token đầu vào và 10 USD/triệu token đầu ra, áp dụng đến hết 31/8. Giá chuẩn — 3 USD đầu vào / 15 USD đầu ra mỗi triệu token — có hiệu lực từ 1/9. Đó là mức tăng 50% ở cả hai chiều, trên chính model mà phần lớn team đã chuyển hẳn workload agent sang vì nó là model mặc định mới của Claude Code, đi kèm cửa sổ ngữ cảnh 1 triệu token và adaptive thinking bật sẵn.

GitHub Copilot Studio cũng đổi đúng ngày này. Gói Business giảm từ 30 xuống 19 USD credit hàng tháng đi kèm; Enterprise giảm từ 70 xuống 39 USD. Giá thuê bao không đổi — thứ bạn nhận được cho số tiền đó co lại. Thêm vào đó, mọi agent và workflow được xây bằng Copilot harness tạo trước ngày 3/8/2026 — kể cả những cái nằm quên trong môi trường Dev hay Trial — bắt đầu tiêu tốn Copilot Credits lần đầu tiên hôm nay, cho cả việc tạo lẫn khi chạy thực tế.

Không cái nào là bất ngờ nếu bạn đã đọc kỹ phần chữ nhỏ hồi tháng 6. Cả hai đều là bất ngờ nếu bạn chưa đọc, vì giá khuyến mãi hiếm khi có thông báo lần hai khi hết hạn — nó chỉ đơn giản là kết thúc.

Vì Sao Chuyện Này Cứ Lặp Lại

Đây không phải trùng hợp, và cũng không phải lần cuối. Mô hình này giờ đã đủ rõ ràng để lên kế hoạch:

  1. Model hoặc tính năng mới ra mắt với giá ưu đãi để thúc đẩy người dùng chuyển sang và cạnh tranh với đối thủ cũ (Sonnet 5 có giá thấp hơn tier Opus lúc ra mắt, credit khuyến mãi của Copilot Studio thấp hơn mức tiêu thụ ổn định).
  2. Team chuyển đổi nhanh vì mức giá ưu đãi khiến việc chuyển gần như không cần suy nghĩ — chẳng ai trì hoãn dùng một model rẻ hơn, tốt hơn.
  3. Khuyến mãi có ngày kết thúc cố định ngay từ đầu, thường là 60-90 ngày sau, nằm sâu trong bài thông báo chứ không phải tiêu đề.
  4. Mức tăng xuất hiện như “trở lại bình thường” thay vì “tăng giá”, điều này về mặt kỹ thuật đúng nhưng vẫn khiến chi phí vận hành của bạn tăng vọt.

Nếu bạn lập ngân sách công cụ AI theo chu kỳ quý, bài học thực tế là: coi mọi dòng “giá ưu đãi đến ngày [x]” là một lời nhắc lịch, không phải chú thích phụ.

Bài Toán Thực Tế

Đây là ý nghĩa của thay đổi Sonnet 5 với một team chạy workflow agentic ở mức trung bình — giả sử 50 triệu token đầu vào và 15 triệu token đầu ra mỗi tháng, con số thực tế với team 6-8 kỹ sư chạy Claude Code với subagent cho review code, viết test, và refactor:

Trước 1/9 (giá ưu đãi):
  Đầu vào:  50M token × 2 USD/M  = 100 USD
  Đầu ra:   15M token × 10 USD/M = 150 USD
  Tổng: 250 USD/tháng

Sau 1/9 (giá chuẩn):
  Đầu vào:  50M token × 3 USD/M  = 150 USD
  Đầu ra:   15M token × 15 USD/M = 225 USD
  Tổng: 375 USD/tháng

Chênh lệch: +125 USD/tháng (+50%)

Năm mươi phần trăm nghe đáng lo cho đến khi bạn so với chi phí trước đây cho reasoning tier Opus trước khi Sonnet 5 tồn tại — mức giá mới này nhiều khả năng vẫn rẻ hơn mức nền hồi tháng 3 của bạn. Rủi ro không nằm ở chỗ giá mới không đáng tiền. Mà là một team lập ngân sách theo con số tháng 3 và chưa bao giờ xem lại giờ đang vượt kế hoạch 50% mà không có dòng chi phí nào giải thích lý do.

Với Copilot Studio, bài toán credit rõ ràng hơn nhiều: nếu tổ chức của bạn có agent tạo trước ngày 3/8 mà bạn nghĩ là “miễn phí” vì chúng chưa từng tiêu credit, hãy kiểm tra báo cáo tiêu thụ trong Power Platform admin center tuần này, đừng để đến quý sau. Một agent nằm im trong môi trường Dev đột nhiên tính vào một pool credit đã bị co lại chính là kiểu chuyện tạo ra tin nhắn Slack bất ngờ từ phòng tài chính vào tháng 10.

Nên Làm Gì

Kiểm toán mức tiêu thụ token theo từng workflow, không phải theo công cụ. Một con số “chúng ta chi X USD cho Claude” chung chung che giấu workflow nào tốn nhiều token đầu ra (sinh code, viết tài liệu dài) so với workflow tốn nhiều token đầu vào (review code với ngữ cảnh lớn, truy xuất kiểu RAG). Token đầu ra chịu mức tăng tương đối lớn hơn trong thay đổi Sonnet 5 (10→15 USD, tăng 50% ở phía đắt hơn của bảng giá), nên workflow sinh ra nhiều văn bản — không chỉ đọc nhiều ngữ cảnh — là nơi chênh lệch tập trung.

Đặt lịch kiểm tra định kỳ ngày hết hạn giá khuyến mãi, không chỉ cho công cụ bạn đang dùng hôm nay mà cho cả model tiếp theo bạn sẽ dùng. Khi chuyển sang model mới vì giá ra mắt hấp dẫn, hãy ghi ngay ngày hết hạn khuyến mãi vào tài liệu theo dõi chi phí ngay hôm bạn chuyển.

Với Copilot Studio, kiểm kê agent nằm im ngay bây giờ. Bất cứ agent nào tạo trước ngày 3/8 trong môi trường Dev hoặc Trial mà không ai đụng tới kể từ đó nên được nâng cấp thành workflow thật có người theo dõi, hoặc xóa đi — để nó lơ lửng chỉ có nghĩa là nó âm thầm tiêu credit từ một pool nhỏ hơn mà không ai để mắt.

Mô hình hóa cách dùng tham số effort. Adaptive thinking của Sonnet 5 (điều khiển bằng tham số effort: low/medium/high/max/xhigh) nghĩa là khối lượng token đầu ra giờ là một núm điều chỉnh, không chỉ là hàm số của độ phức tạp tác vụ. Một workflow mặc định dùng effort high cho tác vụ không cần mức đó đang trả giá đầu ra mới, cao hơn cho token reasoning không cần thiết. Kiểm toán cấu hình effort so với độ phức tạp thực tế của tác vụ giờ là một đòn bẩy tối ưu chi phí hợp lý, giống như việc chọn đúng tier model trước đây.

Bài Học Rộng Hơn

Giá công cụ AI năm 2026 hoạt động ít giống SaaS truyền thống (giá niêm yết ổn định, thỉnh thoảng đổi gói) mà giống giá spot của điện toán đám mây kết hợp với thuê bao — rẻ lúc đầu, điều chỉnh dần về mức ổn định khi kinh tế đơn vị của nhà cung cấp lắng xuống. Đó là mô hình kinh doanh hợp lý cho họ. Nhưng lại là vấn đề lập kế hoạch cho bạn nếu quy trình ngân sách giả định giá cố định giữa các kỳ xem xét theo quý.

Cách khắc phục không phức tạp: đối xử với chi phí công cụ AI giống cách một team trưởng thành đã đối xử với chi phí hạ tầng cloud — một dòng chi phí được theo dõi, có cảnh báo, với rủi ro tăng bậc đã biết trước, không phải một khoản thuê bao cố định đặt một lần rồi quên. Vách giá hôm nay đã thấy trước được từ tháng 6 nếu bạn để ý. Vách tiếp theo cũng vậy.


Thuận Lương là Technical Lead với hơn 15 năm kinh nghiệm về .NET, kiến trúc cloud và hệ thống AI. Anh viết về những bài học thực tế từ việc xây dựng hệ thống production.

Xuất nội dung

Bình luận