Tóm tắt nhanh:
- PilotDeck là nền tảng AI agent mở, workspace-first: mỗi dự án có một “deck” riêng với file, bộ nhớ và kỹ năng tách biệt, giúp agent thực sự làm việc chứ không chỉ trò chuyện.
- Hệ thống cung cấp white-box memory có thể quan sát và chỉnh sửa, router thông minh giảm chi phí token, cùng chế độ Always On để agent tự động tiếp tục công việc dài hạn.
- Cài đặt cực nhanh bằng một dòng lệnh trên macOS/Linux, truy cập qua trình duyệt, tự host bằng Docker và kết nối với các provider LLM phổ biến, phù hợp cho developer, team AI và người làm nội dung muốn xây dựng hệ thống agent production-grade.
PilotDeck là nền tảng AI agent mã nguồn mở, được thiết kế “workspace-first” để giải quyết các bài toán năng suất thật thay vì chỉ cung cấp một giao diện chat. Thay vì gom mọi thứ vào một session, PilotDeck tổ chức agent theo WorkSpace: mỗi dự án là một “deck” riêng, có bộ nhớ, file và kỹ năng độc lập, giúp workflow phức tạp vẫn giữ được cấu trúc rõ ràng.
Dự án được open-source bởi nhóm Tsinghua THUNLP, ModelBest, OpenBMB và AI9Stars, hướng tới vai trò “agent operating system” chứ không chỉ là framework thử nghiệm.

Tại sao PilotDeck đáng chú ý với developer và team AI
PilotDeck nổi bật ở cách nó xử lý ba vấn đề khó nhất của agent: bộ nhớ, routing mô hình và tính tự động.
- WorkSpace isolation: mỗi dự án có file system, memory store và skill set riêng, tránh việc ngữ cảnh bị “bleed” giữa các dự án khác nhau.
- White-box memory: thao tác bộ nhớ minh bạch, có thể xem, sửa, rollback (Dream Mode), tránh tình trạng vector store black-box khó debug.
- Cost-saving router: router tự động hạ cấp nhiệm vụ đơn giản xuống mô hình rẻ, giữ mô hình mạnh cho bài toán khó, giúp tiết kiệm ngân sách token trong workload dài hạn.
Kiến trúc WorkSpace và bộ nhớ trắng (white-box memory)
Ở mức kiến trúc, PilotDeck bắt đầu từ khái niệm WorkSpace: “One deck per project”, mỗi deck là một buồng làm việc riêng với bộ nhớ, file và kỹ năng riêng biệt. Điểm quan trọng là WorkSpace không chỉ là folder, mà còn gắn với concept Project Memory và Feedback Memory, giúp agent vừa ghi nhớ diễn tiến dự án vừa học từ phản hồi của người dùng.
White-box memory nghĩa là mọi mục bộ nhớ đều người đọc được, có thể audit, xoá, chỉnh sửa, rollback, thay vì chỉ lưu embedding trong vector store. Cách tiếp cận này giúp việc fix bug, tối ưu prompt và phân tích hành vi agent trong môi trường production dễ dàng hơn rất nhiều.
Các trường hợp sử dụng điển hình
PilotDeck được thiết kế cho các workflow kéo dài nhiều giờ/ngày, nơi agent cần duy trì trạng thái và tiếp tục làm việc mà không cần người dùng “babysit”.
Một số use case showcase tiêu biểu:
- Work document generation: khảo sát thị trường ứng dụng LLM, tự động tạo báo cáo HTML hoàn chỉnh (white paper) với bảng biểu, trích dẫn và cấu trúc chuyên nghiệp.
- Mini-game development: xây dựng mini game chạy trong trình duyệt ở chế độ Vibe Coding, nơi agent vừa viết code vừa điều chỉnh logic theo yêu cầu dự án.
- AI engineering platform: tạo một nền tảng low-code để fine-tune embedding và quản lý pipeline ML ở chế độ agent-driven.
- Podcast multilingual push: sinh trang giới thiệu podcast ở nhiều ngôn ngữ chỉ từ một prompt, kèm ảnh bìa được tối ưu theo văn hoá từng thị trường.
Chuẩn bị trước khi cài đặt PilotDeck
Để cài PilotDeck bản web, bạn cần chuẩn bị:
- Hệ điều hành: macOS hoặc Linux để dùng script cài đặt một dòng; Windows hiện hỗ trợ chế độ developer.
- Kết nối mạng: ổn định để tải mã nguồn và kết nối tới API LLM.
- API key LLM: khóa truy cập cho provider bạn chọn (OpenAI, Anthropic, OpenRouter, MiniMax, DeepSeek…).
Bản desktop app (DMG) cũng có sẵn cho người dùng macOS muốn trải nghiệm native UI, nhưng trong bài viết này mình tập trung vào bản web self-hosted để dễ tự động hoá và tích hợp vào hạ tầng hiện tại.
Cài đặt nhanh bằng script một dòng (Web version)
PilotDeck hỗ trợ cài đặt cực nhanh bằng một script shell duy nhất trên macOS/Linux.
Mở terminal và chạy:
curl -fsSL https://raw.githubusercontent.com/OpenBMB/PilotDeck/main/install.sh | bashTrong quá trình cài đặt, hệ thống có thể yêu cầu mật khẩu để tạo symlink pilotdeck tại /usr/local/bin hoặc ~/.local/bin, đây là hành vi bình thường của shell.
Sau khi script hoàn tất, lệnh pilotdeck sẽ sẵn sàng trong PATH, cho phép bạn khởi động dịch vụ bằng một câu lệnh đơn giản.
Khởi động PilotDeck:
pilotdeckSau khi chạy, PilotDeck sẽ phục vụ tại http://localhost:3001, trình duyệt thường tự mở trang setup, nếu không bạn có thể truy cập thủ công bằng URL này.
Thiết lập LLM provider sau khi cài đặt
Lần đầu truy cập PilotDeck, bạn sẽ thấy trang “LLM Provider Setup” để kết nối tới mô hình ngôn ngữ mà bạn muốn dùng.
Quy trình cấu hình cơ bản:
- Chọn preset: thanh trên cùng cung cấp preset cho Anthropic, OpenRouter, MiniMax, OpenAI… Khi chọn preset, các trường API Base URL, Model ID và Protocol Type sẽ được điền tự động.
- Điền thông tin API: nếu provider của bạn không có trong preset (ví dụ DeepSeek), hãy tự nhập API Base URL, API Key và Model ID.
- Test connection: bấm “Test Connection”; nếu nhận thông báo “Connected successfully”, kết nối đã hoạt động. Nếu lỗi, cần kiểm tra lại key, URL, hạn mức và mạng.
- Lưu cấu hình: sau khi test thành công, bấm “Save”. Cấu hình sẽ được ghi vào
~/.pilotdeck/pilotdeck.yaml.
Khi vào giao diện chính, chỉ cần gửi một message trong ô input; nếu agent trả lời bình thường tức là cài đặt và cấu hình đã hoàn tất.
Khởi động, dừng và cập nhật PilotDeck
Các thao tác runtime phổ biến:
- Start: chạy
pilotdecktrong terminal; mặc định dùng port 3001 cho web UI. - Use: truy cập
http://localhost:3001trong trình duyệt để làm việc với WorkSpace, memory và các agent. - Stop: nhấn
Ctrl + Ctrong terminal để dừng dịch vụ một cách sạch, tránh conflict port về sau. - Update: đơn giản chạy lại script cài đặt một dòng để tải cập nhật mới của PilotDeck.
Nếu port 3001 hoặc 18080 bị chiếm, tài liệu khuyến nghị dùng lsof và kill -9 để giải phóng, hoặc start PilotDeck với một port khác bằng tuỳ chọn --port:
# Start với port khác
pilotdeck --port 8080
# Sau đó truy cập http://localhost:8080Tự host PilotDeck bằng Docker
Bên cạnh bản cài native, PilotDeck cũng hỗ trợ triển khai tự host bằng Docker, tận dụng file docker-compose.yml trong repo chính thức. Cách tiếp cận này phù hợp nếu bạn muốn đưa PilotDeck vào hạ tầng server, VPS hoặc cluster container hoá hiện có, đồng thời dễ tích hợp với reverse proxy, TLS và hệ thống giám sát.
Ở mức khái niệm, Docker deployment của PilotDeck gồm nhiều component TypeScript, Python và Go, không chỉ là một binary đơn lẻ; điều này phản ánh kiến trúc “thực chiến” chứ không phải hobby script. Tài liệu bên ngoài cũng nhấn mạnh rằng toàn bộ hệ thống được cấp phép AGPL-3.0, tự host hoàn toàn miễn phí; chi phí duy nhất đến từ các call API LLM bên dưới.
Tích hợp PilotDeck vào workflow AI/ML và GEO
Với định hướng “agent OS”, PilotDeck rất phù hợp để trở thành lớp điều phối trung tâm trong hệ thống AI/ML của bạn.
Một số pattern tích hợp:
- Agent cho R&D và nội dung: dùng WorkSpace riêng cho từng dự án research, mỗi deck chứa file, kết quả crawl, prompt và memory; agent có thể xử lý chuỗi task dài (research → tổng hợp → viết báo cáo → xuất HTML/PDF).
- Chi phí tối ưu cho pipeline dài: router tự động phân loại task (tóm tắt, format, xác nhận dùng mô hình rẻ; phân tích phức tạp dùng mô hình mạnh), giúp giữ chất lượng nhưng giảm đáng kể chi phí.
- GEO (Generative Engine Optimization): thay vì chỉ SEO cho Google, bạn có thể dùng PilotDeck để liên tục chạy agent tạo nội dung chuẩn hoá, có cấu trúc, được feed vào các công cụ LLM của người dùng (chatbot, trợ lý nội bộ), nâng cao khả năng khám phá nội dung qua generative engine.
Ở góc nhìn content creator và technical blogger, bạn có thể:
- Dùng agent trong PilotDeck để khảo sát, phân tích và tóm tắt landscape công cụ AI / agent framework.
- Để agent tạo khung bài, bảng so sánh, outline cho blog post.
- Tinh chỉnh thủ công, thêm góc nhìn chuyên môn; kết quả là nội dung vừa thân thiện SEO, vừa được tối ưu cho engine sinh nội dung (GEO) nhờ cấu trúc, heading rõ ràng và ngôn ngữ mô tả nhiệm vụ tốt.
Nếu bạn đang xây một stack AI/ML tự host, muốn có một tầng điều phối agent đủ nghiêm túc cho production nhưng vẫn dễ cài đặt và tuỳ biến, PilotDeck là một trong những dự án đáng để dành thời gian thử nghiệm và viết tiếp những công cụ, workflow của riêng bạn trên nền tảng đó.








