Manus AI Agent — Thử nghiệm thực tế và bảng giá của AI Agent tự động hoàn thành nhiệm vụ

Manus ra mắt vào tháng 3 năm 2025 với danh xưng "AI Agent đa năng đầu tiên trên thế giới", điểm khác biệt lớn nhất không nằm ở năng lực mô hình mà ở chỗ nó mặc

Manus ra mắt vào tháng 3 năm 2025 với danh xưng "AI Agent đa năng đầu tiên trên thế giới", điểm khác biệt lớn nhất không nằm ở năng lực mô hình mà ở chỗ nó mặc định thực thi nhiệm vụ trên "máy ảo đám mây bất đồng bộ" — bạn tắt trình duyệt, nó vẫn tiếp tục chạy. Sau khi thử nghiệm thực tế 12 nhiệm vụ, bốn nhóm thực sự bàn giao ổn định là: thu thập dữ liệu, sắp xếp bảng biểu, tạo bản trình chiếu và tạo trang web; những nhiệm vụ cần đăng nhập tài khoản, thanh toán, hoặc ghi dữ liệu xuyên hệ thống có tỷ lệ thất bại cao rõ rệt. Về giá, từ gói khởi điểm 39 đô la Mỹ gây tranh cãi lớn ở giai đoạn đầu, nay đã chuyển sang chế độ Credit (điểm), chi phí phụ thuộc nhiều vào độ phức tạp của nhiệm vụ chứ không phải số giờ sử dụng. Manus là gì: khác biệt về cấu trúc so với ChatGPT và Claude Manus là một AI Agent tự chủ do đội ngũ Trung Quốc Monica (Butterfly Effect) phát triển, phát hành bản xem trước ngày 6 tháng 3 năm 2025, sau đó trụ sở công ty chuyển sang Singapore. Bản thân nó không huấn luyện mô hình nền tảng, mà xây thêm một lớp "bộ lập kế hoạch + máy ảo sandbox + bộ công cụ" trên các mô hình sẵn có như Anthropic Claude. Khác biệt về cấu trúc quyết định tình huống sử dụng. Giao diện hội thoại của ChatGPT và Claude về bản chất là "lượt đồng bộ": bạn hỏi một câu, nó trả lời một câu, nhiệm vụ dài phải dựa vào việc bạn liên tục hỏi tiếp để đẩy tiến độ. Sau khi nhận lệnh, Manus sẽ tạo trước một danh sách nhiệm vụ todo.md , rồi thực thi từng mục trong máy ảo Linux trên đám mây — mở trình duyệt, tải tệp, viết script Python, chạy lệnh shell, tạo ra tệp kết quả, toàn bộ quá trình không cần bạn có mặt. Điểm khởi đầu của làn sóng quan tâm này là thành tích benchmark mà hãng công bố khi ra mắt: "Manus đạt thành tích SOTA tại thời điểm đó ở cả ba cấp độ khó của GAIA benchmark, Level 1 đạt 86,5% (nguồn: GAIA Benchmark Leaderboard / Hugging Face)" . GAIA là bài đánh giá trợ lý đa năng do Meta AI, Hugging Face và đội ngũ AutoGPT cùng đề xuất, các câu hỏi đòi hỏi suy luận nhiều bước cộng với

相關工具書

Đã được xem xét và xác minh bởi FeiYueh · Lần xác minh gần nhất 2026-09-17. Independently maintained — not AI-generated boilerplate.

← Back to Blog