Ý TƯỞNG, QUYẾT ĐỊNH & BÀI HỌC

Bài viết

Ghi chép về AI, kiến trúc và xây dựng sản phẩm từ thực tế.

80 bài viết

09 Sep 2026 · 8 phút đọc

ai

Claude hình thức hóa Định lý cuối của Fermat bằng Lean: 13 triệu dòng chứng minh máy-kiểm-tra dạy gì cho người xây agent

Claude của Anthropic tạo ra một chứng minh Lean dài 13 triệu dòng, được máy xác minh toàn bộ, cho Định lý cuối của Fermat trong 11 ngày thông qua bộ điều phối mã nguồn mở Prove2Me. Góc nhìn Tech Lead: pattern điều phối đa agent phía sau nó có ý nghĩa gì cho bất kỳ team nào đang xây agent tự động chạy dài hạn.

Đọc tiếp

09 Sep 2026 · 7 phút đọc

ai

HydraFusion của GitHub Copilot: Điều hướng đa model runtime thực sự thay đổi gì cho team bạn

HydraFusion chọn kế hoạch thực thi theo từng tác vụ trên nhiều nhà cung cấp model — cascade, critique, hay single-shot — và được báo cáo là vượt chất lượng Claude Opus 5 trên TerminalBench 2.1 với chi phí thấp hơn 36-67%. Góc nhìn Tech Lead: đây có thay thế logic model-routing của bạn, hay chỉ chuyển nó sang chỗ khác?

Đọc tiếp

07 Sep 2026 · 6 phút đọc

ai

NVIDIA Nemotron 3 Ultra: Kiến trúc lai Mamba-Transformer MoE mang lại gì thực sự cho production

Nemotron 3 Ultra kết hợp các lớp Mamba (state-space) với attention của transformer và một bộ định tuyến mixture-of-experts để đạt context 1 triệu token với throughput gấp 5 lần các mô hình dense tương đương. Góc nhìn Tech Lead về kiến trúc này và nơi nó thay đổi bài toán chi phí triển khai agent.

Đọc tiếp

03 Sep 2026 · 7 phút đọc

agentic coding

32% Bỏ Qua Mua Phần Mềm, Tác Động EBIT Vẫn Giữ Nguyên 37%: Đọc Con Số Build-vs-Buy 2026 Của McKinsey

Khảo sát State of AI 2026 của McKinsey cho thấy một phần ba tổ chức bỏ qua việc mua phần mềm vì agentic coding giúp tự build được trong nội bộ — nhưng tỷ lệ báo cáo tác động EBIT thật sự từ AI không hề nhích lên. Khoảng cách đó thực sự nghĩa là gì cho một quyết định build-vs-buy, từ người đã tự đưa ra vài quyết định như vậy trong năm nay.

Đọc tiếp

30 Aug 2026 · 6 phút đọc

ai

GLM-5.3-Flash: Model Open-Weight Đầu Tiên Tôi Thực Sự Tin Tưởng Với Context 1 Triệu Token

GLM-5.3-Flash của Z.ai, license MIT, kết hợp MoE 320B-A18B với cơ chế attention lai linear/sparse được thiết kế riêng để context triệu token thực sự dùng được, không chỉ khả dụng trên giấy. Góc nhìn Technical Lead về IndexPool, bài toán tự host, và vị trí của nó cạnh các model frontier đóng.

Đọc tiếp