Ý TƯỞNG, QUYẾT ĐỊNH & BÀI HỌC

Bài viết

Ghi chép về AI, kiến trúc và xây dựng sản phẩm từ thực tế.

27 bài viết

26 Sep 2026 · 8 phút đọc

agents

Cursor Vừa Đưa Chìa Khóa Nút Rollback Cho Một Con Agent

Rollouts và Security Reviewer của Cursor theo dõi PR của bạn từ lúc merge tới lúc chạy production, và có thể tự mở PR revert. Mình thích ý tưởng này, nhưng không tin cấu hình mặc định — đây là chính sách mình sẽ đặt quanh hai con agent này trước khi thả chúng ra.

Đọc tiếp

17 Sep 2026 · 5 phút đọc

ai

Gemini 3.8 Flash Cyber Của Google Vượt Mọi Model Frontier Trong Việc Tìm Bug. Điều Này Thay Đổi Gì Trong CI Pipeline

Gemini 3.8 Flash Cyber đạt 86.2% trên CyberGym, vượt qua Mythos 5 và GPT-5.6 Sol, còn đội bảo mật Chrome nói nó tạo ra patch đúng nhiều gấp 2.6 lần so với các model thương mại lớn hơn. Góc nhìn Technical Lead về việc một model bảo mật chuyên biệt thực sự thay đổi gì cho quy trình AppSec.

Đọc tiếp

13 Sep 2026 · 6 phút đọc

agentic coding

SWE-2 Của Cognition: 'Một Lần RL, Ba Mức Effort' Thực Sự Mang Lại Gì

SWE-2 đạt điểm ngang Fable 5.1 trên FrontierCode với chi phí thấp hơn 64% và giảm 58% số lượt thao tác so với model tiền nhiệm — bằng cách huấn luyện các mức reasoning-effort có thể chọn trong một lần RL duy nhất thay vì tách thành nhiều model riêng. Góc nhìn Technical Lead về đánh đổi chi phí-hiệu năng.

Đọc tiếp