07 Oct 2026 · 10 phút đọc
agentic-ai
4. Chứng minh model chatbot nhỏ có đủ tốt không
Tạo bộ test độc lập, chấm câu trả lời có căn cứ và đo chất lượng, chi phí, coverage cùng lúc.
Đọc tiếpÝ TƯỞNG, QUYẾT ĐỊNH & BÀI HỌC
Ghi chép về AI, kiến trúc và xây dựng sản phẩm từ thực tế.
32 bài viết
07 Oct 2026 · 10 phút đọc
agentic-ai
Tạo bộ test độc lập, chấm câu trả lời có căn cứ và đo chất lượng, chi phí, coverage cùng lúc.
Đọc tiếp09 Sep 2026 · 5 phút đọc
agentic-ai
Bản cập nhật Claude Code tháng 9 của Anthropic âm thầm nâng bashOutputMaxChars và taskOutputMaxChars lên 128K, thêm flag đọc system prompt cho subagent từ file. Góc nhìn Tech Lead: vì sao thay đổi không hào nhoáng này lại quan trọng hơn nhiều bản công bố model, với những ai đang chạy pipeline fan-out subagent.
Đọc tiếp07 Sep 2026 · 6 phút đọc
adoption
Chi tiêu AI mỗi researcher tại OpenAI gần như bằng 0 đến hết tháng 2/2026, rồi vọt lên khoảng $600/ngày vào cuối tháng 8 — không phải vì mandate, mà vì một model cuối cùng vượt qua ngưỡng adoption. Góc nhìn Tech Lead về ý nghĩa hình dạng đường cong này cho rollout của chính bạn.
Đọc tiếp08 Aug 2026 · 7 phút đọc
agentic-ai
Trong cùng một tuần, UK AISI ghi nhận 17 hành động trái phép trong cyber eval, Anthropic xác nhận truy cập production không được phép, và OpenAI agents vô tình tấn công Hugging Face. Cả ba sự cố có cùng một nguyên nhân gốc rễ — và có một cách sửa chung.
Đọc tiếp28 Jul 2026 · 7 phút đọc
agentic-ai
Agent AI 100 bước của bạn crash ở bước 87. Điều gì xảy ra tiếp theo? Durable execution giải quyết bài toán fault-tolerance căn bản trong production agentic workflows. Đây là phân tích kỹ thuật và decision framework thực tế.
Đọc tiếp27 Jul 2026 · 8 phút đọc
agentic-ai
Martin Fowler đã nêu tên nó. Verification là bottleneck, không phải code generation. Harness engineering — thiết kế loops, scaffolding và constraints quanh AI — đang trở thành discipline kỹ thuật có giá trị nhất năm 2026. Đây là playbook thực tế.
Đọc tiếp20 Jul 2026 · 8 phút đọc
agentic-ai
Google vừa công bố chuẩn mở ARD (v0.9, 2026) — định nghĩa cách AI agent tự động khám phá tools qua ai-catalog.json. Hướng dẫn thực tế cho Tech Lead: so sánh với MCP, cách làm platform của bạn agent-discoverable ngay hôm nay.
Đọc tiếp18 Jul 2026 · 9 phút đọc
agentic-ai
Hướng dẫn thực tế cho Tech Lead về các cuộc tấn công prompt injection, jailbreaking, và các pattern phòng thủ — kèm sự cố thực tế tháng 7/2026, code examples, và giải pháp cho AI agents trên production.
Đọc tiếp09 May 2026 · 17 phút đọc
agentic-ai
Câu hỏi trung tâm của việc xây dựng hệ thống AI đã thay đổi ba lần trong bốn năm — từ 'nói gì với model?' đến 'xây hệ thống gì?'. Deep dive về prompt engineering, context engineering, và harness engineering với architecture diagrams, decision frameworks, và production lessons cho engineering leaders.
Đọc tiếp