Ý TƯỞNG, QUYẾT ĐỊNH & BÀI HỌC

Bài viết

Ghi chép về AI, kiến trúc và xây dựng sản phẩm từ thực tế.

323 bài viết

27 Aug 2026 · 5 phút đọc

agentic engineering

Playbook của Hive — năm workflow biến nền tảng agent của tôi thành cả một đội

Tôi tự host một nền tảng agent trên phần cứng sẵn có. Model chưa bao giờ là phần khó. Phần khó là playbook: đúng những tổ hợp engine, tool và surface biến một nền tảng duy nhất thành lập trình viên, người nghiên cứu, cổng QA và business analyst. Đây là năm workflow tôi thực sự chạy.

Đọc tiếp

27 Aug 2026 · 8 phút đọc

agentic coding

Grok Voice Think Fast 2.0: Điều Gì Thực Sự Thay Đổi Khi Gộp STT-LLM-TTS Vào Một WebSocket Duy Nhất

Think Fast 2.0 của SpaceXAI gộp nhận diện giọng nói, suy luận và tổng hợp giọng nói vào một model speech-to-speech duy nhất qua một WebSocket. Tôi xây một voice agent chăm sóc khách hàng để test API này và rút ra các best practice thực chiến: timing, xử lý ngắt lời, resumption, và bảo mật.

Đọc tiếp

26 Aug 2026 · 5 phút đọc

ai-agents

Docker Sandboxes trong GitHub Actions: Cuối cùng cũng có câu trả lời cho câu hỏi 'Nếu agent làm loạn trong CI thì sao'

Docker vừa ra mắt sandbox cách ly bằng microVM, tích hợp thẳng vào GitHub Agentic Workflows — cho AI coding agent một Docker daemon riêng và quyền sudo mà không đụng đến secret hay host của runner. Bài viết phân tích kiến trúc, ví dụ YAML thực tế, và những điểm còn chưa hoàn thiện.

Đọc tiếp

26 Aug 2026 · 5 phút đọc

agentic engineering

Không Thể Ship Agent Bằng Cảm Tính — Eval Cho Hệ Agentic

Một dòng chỉnh prompt có thể âm thầm làm hỏng một agent, và bạn chỉ biết khi user gặp. Cách sửa của tôi là một eval harness: một golden set gồm input và check, chạy với mọi agent và workflow mỗi lần đổi. Đây là phần giải phẫu — check tĩnh, LLM-as-judge, regression run-on-change, và chấm cả workflow đa-agent.

Đọc tiếp

26 Aug 2026 · 6 phút đọc

ai-agents

Claude Desktop giờ đã nói chuyện được với Ollama: Nút bật model local thực sự mang lại gì

Ollama v0.33.0 ra mắt một gateway điều khiển bằng UI, cho phép Claude Desktop chạy model Qwen, DeepSeek, Kimi ngay trên máy — không phải MCP server, không phải tính năng của Anthropic, mà hoàn toàn là proxy của riêng Ollama. Bài viết phân tích cơ chế hoạt động, đánh đổi về tốc độ/tool-calling, và khi nào đáng bật cho cả team.

Đọc tiếp