
Google Antigravity 2.0: màn hình cài đặt mới là phần đáng đọc
Google Antigravity 2.0: màn hình cài đặt mới là phần đáng đọc
Google phát hành hai thứ khác nhau dưới cùng một cái tên, và chọn nhầm sẽ lặng lẽ đẩy bạn vào sai quy trình suốt nhiều tuần.
| Antigravity 2.0 | Antigravity IDE | |
|---|---|---|
| Là gì | nền tảng agent chạy độc lập (app desktop hoặc CLI) | trình soạn thảo code, gần giống VS Code |
| Dùng thế nào | giao hẳn một task lớn; nó tự chia nhỏ và điều phối sub-agent | tự mở file, tự đọc và sửa code, có AI hỗ trợ |
| Tư duy | headless — việc diễn ra bên dưới bề mặt | trực tiếp — bạn ngồi trong file |
Hai thứ này bổ trợ nhau, không cạnh tranh: ngay trong app 2.0 có nút Open IDE, và dùng song song hai bên là cách làm dễ chịu nhất. Nhưng nếu bạn đi tìm "câu trả lời của Google cho agentic coding" mà lại rơi vào trình soạn thảo, bạn sẽ kết luận đây chỉ là một bản sao của Cursor rồi bỏ qua.
Về bài viết này
Viết từ video trên kênh. Phần đi qua giao diện và phần dựng app là những gì diễn ra trên màn hình. Chỗ nào là con số từ trang của hãng hoặc từ bảng xếp hạng bên thứ ba chứ không phải từ lần chạy, mình ghi rõ — và vài tên tính năng trong phụ đề tự động sai quá nặng nên mình mô tả theo hành vi thay vì đoán bừa.
Đây là bản viết của video, nơi toàn bộ các màn hình cài đặt, lượt dựng app ba agent và job chạy theo lịch đều được đi qua trực tiếp trên màn hình.
Muốn xem thẳng trên YouTube?
Xem trên YouTube — hoặc đăng ký kênh để đón video tiếp theo.
Phần ai cũng lướt qua
Phần lớn bài review dành thời lượng cho màn dựng app. Đó là phần lên hình đẹp.
Nhưng đây là công cụ có bộ lập lịch, có chế độ chạy liên tục không dừng lại hỏi bạn câu nào, và có sub-agent thực thi lệnh shell. Câu hỏi đáng quan tâm không phải là nó có dựng nổi một app flashcard hay không. Mà là: nó được phép đụng vào những gì lúc 8 giờ sáng thứ Ba, khi lịch chạy nổ và bạn không ngồi ở bàn.
Câu trả lời của Antigravity chi tiết một cách khác thường, và đáng biết là các trục này tồn tại:
- Quyền file — đọc và ghi, khai báo theo từng đường dẫn.
- Quyền mạng — cho phép hoặc chặn, theo từng trang.
- Quyền terminal — cho phép hoặc chặn, theo từng lệnh.
- Lệnh chạy ngoài sandbox — agent chạy trong sandbox; việc nó có được bước ra ngoài hay không là một thiết lập riêng, tường minh.
- MCP tool — những công cụ ngoài nào được phép lộ ra.
Mỗi mục trong số đó đều có giá trị mặc định. Mặc định chính là lựa chọn bạn đang chọn, dù bạn có mở màn hình đó ra hay không.
Hai thiết lập bỏ sót là mất tiền
Quota model dùng chung cho các model Claude. Dùng Sonnet và Opus không phải là hai túi riêng — tiêu ở bên này là đã tiêu cho cả bên kia. Quota làm mới theo chu kỳ vài giờ.
"Enable AI credits" là công tắc tiêu vượt. Tắt thì hết quota là dừng. Bật thì chạy tiếp và tính tiền. Video cố ý để tắt, và đó là mặc định đúng cho bất kỳ ai chưa theo dõi mức đốt của chính mình trong một tháng.
Còn một tuỳ chọn chống ngủ nữa, nghe vặt vãnh cho tới khi một lượt build chạy nửa tiếng và máy bạn sleep ngay giữa chừng.
Màn dựng app, và một dòng đáng lấy trong prompt
Demo dựng Aura English, một app flashcard, với ba agent chạy song song: backend (Spring, clean architecture), frontend (React + TypeScript kèm thư viện component), và QA (test tự động).
Dòng đáng lấy trong prompt là collaboration protocol: trước khi sinh code, các agent peer-review lẫn nhau dựa trên một bản hợp đồng API chung, để frontend không tự bịa ra endpoint mà backend chưa từng dựng. Thiếu dòng đó, agent song song sẽ đẻ ra hai nửa không khớp — đúng cái lỗi đặc trưng của multi-agent codegen, và là lý do phần lớn mọi người bỏ cuộc với nó.
Ngoài ra còn lựa chọn giữa chạy thẳng trên thư mục làm việc và chạy trên git worktree mới. Tuỳ chọn worktree đặt mỗi agent lên một nhánh riêng để việc song song không giẫm chân nhau. Chạy từ ba agent trở lên thì đây là thiết lập giữ cho kết quả còn merge được.
Thực tế diễn ra thế nào
| Sinh xong file plan | ~22 giây |
| Agent frontend | ~3 phút |
| Agent backend | ~2 phút |
| Sau đó | agent QA tự động khởi động |
Agent QA tìm ra bug thì đẩy ngược về đúng agent sở hữu tầng đó — bug frontend về agent frontend, bug backend về agent backend — và vòng lặp chạy tới khi test xanh hết. Xem cái màn bàn giao qua lại đó mới là phần thật sự mới: đây là một giao thức làm việc nhóm, không phải một pipeline.
Chỗ nó chưa tới
Mất ba vòng, và video nói thẳng điều đó.
App giao ra mà không có chỗ nào để tạo card. Phải tự insert dữ liệu thẳng vào database. Tác giả nói rõ lỗi này là của mình — prompt chưa bao giờ yêu cầu tính năng tạo card, nên chẳng có gì dựng nó cả.
Đó là bài học hữu ích nhất trong cả video và rất dễ lướt qua: agent đã dựng đúng cái app được đặc tả, kể cả cái lỗ hổng trong đặc tả. Agent càng nhanh thì bạn càng sớm chạm mặt hậu quả của một bản yêu cầu mơ hồ.
Rồi tới một bug thật. Lật card xong thì không bấm được các nút đánh giá. Sửa ở frontend làm một test QA fail, kéo agent backend quay lại cập nhật phía nó, chạy lại, rồi mới xanh.
Và một lỗi môi trường — console H2 từ chối kết nối cho tới khi dán lỗi vào nhờ sửa.
Không điều nào trong số đó khiến công cụ này dở. Nó khiến bản demo trung thực: prompt đầu tiên không bao giờ đúng, và giá trị nằm ở chỗ vòng hai và vòng ba rẻ đến mức nào.
Bộ lập lịch mới là tính năng mình sẽ dùng thật
Một prompt kiểu mỗi sáng 8 giờ quét backend tìm bug, lỗ hổng bảo mật và vấn đề hiệu năng, rồi viết cho tôi một báo cáo markdown sẽ được đăng ký thành một job lặp lại. Bạn đến nơi, báo cáo đã nằm đó.
Cái đó hữu ích thật — và cũng chính là lý do phần phân quyền ở trên không phải phần đọc cho vui. Một agent chạy theo lịch, có quyền shell, có quyền mạng và không có ranh giới sandbox là một hồ sơ rủi ro hoàn toàn khác với một khung chat mà bạn đang ngồi nhìn. Buổi bốn và năm của loạt SDLC lập luận đúng điều này từ phía quản trị: tự động hoá phần thực thi, giữ lại phần trách nhiệm.
Về con số tốc độ
Video giải thích vì sao Google đi hướng này bằng bài toán kinh tế của model — một model hạng Flash được nêu là nhanh khoảng ba lần so với các đối thủ nặng ký, với chi phí chưa tới một phần tư, mà điểm số chỉ xếp ngay sau họ trên một bảng xếp hạng năng lực.
Những con số đó đến từ một bảng xếp hạng bên thứ ba và các trang của chính Google, không phải từ lần chạy này. Hãy đối xử với chúng như mọi benchmark có dính tới nhà cung cấp: đáng tham khảo về mặt xu hướng, chưa được kiểm chứng độc lập. Thứ mà chính lần chạy cho thấy là một file plan trong 22 giây — nhất quán với tuyên bố đó, nhưng không chứng minh nó.
Điều mình rút ra
Đọc màn hình phân quyền trước khi đọc danh sách tính năng. Với một công cụ chạy không người trông, mô hình phân quyền chính là bề mặt sản phẩm đáng quan tâm.
Viết collaboration protocol vào thẳng prompt. Agent song song mà không thống nhất hợp đồng chung thì sẽ đẻ ra hai nửa không khớp.
Hãy tính trước cho vòng thứ ba. Prompt đầu luôn có lỗ hổng; agent sẽ dựng lại lỗ hổng đó một cách rất trung thành.
Liên quan
- Buổi 5 — Quy trình làm việc AI-Driven — ranh giới tự chủ của agent dừng ở đâu, nhìn từ phía quản trị.
- Claude Fable 5 trở lại: một demo có thể sai thật — một lần dựng app khác, với bước kiểm chứng khiến kết quả kiểm được.