Kiến thức nền AI Agent · Bài 3

Giải phẫu một AI Agent: bộ não, trí nhớ, công cụ, kênh giao tiếp, lịch tự chạy

Bot AI "lúc khôn lúc dại" thường vì thiếu một bộ phận. Bài viết mổ xẻ 5 bộ phận của một AI Agent bằng hình ảnh nhân viên số, kèm cách OpenClaw và Hermes làm từng phần.

Cập nhật 02/10/2026⏱ 7 phút đọcKiến thức nềnNgười mới

Vì sao bot AI của bạn "lúc khôn lúc dại"?

Một chủ shop thời trang thử cài bot AI trên Telegram. Hôm đầu bot viết bài rất ổn. Hôm sau chị nhắn "viết tiếp như hôm qua", bot hỏi lại "hôm qua là gì ạ?". Chị dặn 8 giờ sáng gửi báo cáo, tới 9 giờ vẫn im lặng. Chị nhờ xem đơn trong bảng tính, bot trả lời không truy cập được.

(Tình huống minh hoạ.)

Bot không "dở". Nó thiếu bộ phận: thiếu sổ tay nên không nhớ, thiếu lịch nên không tự làm, thiếu đôi tay nên không chạm được vào dữ liệu. Hiểu cấu tạo của một AI Agent giúp bạn biết lỗi nằm ở đâu và cần bổ sung gì.

Giải phẫu AI Agent: 5 bộ phận của một nhân viên số

Giải phẫu AI Agent là cách nhìn một Agent như một nhân viên số gồm 5 bộ phận: bộ não (model AI), sổ tay (trí nhớ), đôi tay (công cụ và kỹ năng), điện thoại (kênh giao tiếp) và lịch làm việc (lịch tự chạy).

Khi bạn giao một việc, năm bộ phận phối hợp theo thứ tự quen thuộc:

  1. Lịch hoặc bạn giao việcTin nhắn của bạn, hoặc lịch tự chạy "nhắn" thay bạn
  2. Điện thoại nhận việcTelegram, Zalo… chuyển tin tới Agent
  3. Não đọc sổ tayModel đọc vai trò, quy tắc, trí nhớ rồi lập kế hoạch
  4. Tay làm việcDùng công cụ: đọc bảng tính, tìm web, soạn file
  5. Điện thoại báo lạiGửi kết quả hoặc xin bạn duyệt
  6. Sổ tay ghi thêmLưu điều mới để lần sau làm đúng ý hơn
Thiếu bộ phận nào, bạn phải tự làm thay phần đó.

Nếu chưa rõ AI Agent khác khung chat AI ra sao, hãy đọc AI Agent là gì? trước.

Bộ não: model AI

Model là phần "suy nghĩ": đọc yêu cầu, lập kế hoạch, viết, chọn công cụ. Bạn không mua model một lần mà trả theo lượng dùng cho nhà cung cấp (OpenAI, Anthropic, Google…), hoặc chạy model trên máy riêng.

Vì não tách khỏi phần còn lại, bạn đổi model mà không phải dựng lại Agent: vai trò, trí nhớ, kết nối giữ nguyên. Việc đơn giản dùng model rẻ, việc cần phán đoán dùng model mạnh — giúp bạn cân đối chất lượng và chi phí.

Nguồn: OpenClaw – Model failover · OpenClaw – Prompt injection · Hermes – Providers · Hermes – Quickstart

Sổ tay: trí nhớ và hồ sơ vai trò

Model tự nó không nhớ gì giữa các lần trò chuyện. Agent "nhớ" được là nhờ các file ghi chú được đưa vào đầu mỗi phiên làm việc. Lợi ích: bạn dặn một lần, Agent áp dụng nhiều lần — giọng văn, bảng giá, quy tắc duyệt.

Sổ tay có giới hạn dung lượng nên phải gọn: ghi quy tắc và sự thật bền vững, không chép cả cuộc trò chuyện. Cách viết "bản mô tả công việc" cho Agent: Mô tả công việc cho AI Agent. Trí nhớ xuyên phiên của Hermes: Trí nhớ dài hạn.

Nguồn: OpenClaw – Agent workspace · OpenClaw – Memory · Hermes – Memory

Đôi tay: công cụ và kỹ năng

Công cụ là thao tác Agent làm được: tìm web, đọc – ghi file, chạy lệnh, mở trình duyệt, gửi tin, tạo ảnh. Kỹ năng (skill) là bản hướng dẫn nghiệp vụ dạy Agent làm một việc theo đúng cách. Có công cụ mà thiếu kỹ năng thì Agent làm mỗi lần một kiểu; có kỹ năng thì kết quả đều tay hơn.

Phần lớn "đôi tay" nối với phần mềm khác qua API — giải thích dễ hiểu ở bài API là gì?. Cơ chế tự học kỹ năng: Vòng học khép kín của Hermes.

Nguồn: OpenClaw – Tools · OpenClaw – Tool policy · Hermes – Skills · Hermes – MCP

Điện thoại: kênh giao tiếp

Kênh là nơi bạn giao việc và nhận báo cáo — chính các ứng dụng chat bạn mở mỗi ngày. Bạn không phải học phần mềm mới và giao việc được từ điện thoại ở bất cứ đâu.

Cả hai mặc định không tiếp người lạ: người mới nhắn tới nhận một mã ghép đôi và chỉ trò chuyện được khi bạn duyệt. Hướng dẫn Zalo theo cách chính thức: OpenClaw với Zalo, Hermes với Zalo.

Nguồn: OpenClaw – Channels · OpenClaw – Zalo personal · Hermes – Messaging · Hermes – Security

Lịch làm việc: lịch tự chạy

Đây là bộ phận biến trợ lý thành nhân viên: không cần nhắc. Bạn đặt "mỗi sáng 7:30 báo cáo quảng cáo", Agent tự thức dậy, làm và gửi kết quả.

Lịch chạy cả khi bạn ngủ, nên lịch đầu tiên nên là việc chỉ đọc và báo cáo.

Nguồn: OpenClaw – Automation · Hermes – Cron · Hermes – Security

Khi thiếu một bộ phận, ai làm thay?

Bộ phậnKhi thiếu, bạn phải…Khi đủ, Agent…Người duyệt ở đâu
Bộ nãoTự nghĩ, tự viếtHiểu yêu cầu, lập kế hoạch, viết nhápBạn chọn model, đặt hạn mức chi phí
Sổ tayDặn lại từ đầu mỗi lầnNhớ giọng văn, sản phẩm, quy tắcBạn đọc lại hồ sơ vai trò định kỳ
Đôi tayTự copy số, tự dán, tự đăngTự lấy dữ liệu, soạn file, gửi tinBạn duyệt việc tốn tiền, việc công khai
Điện thoạiMở máy tính, vào phần mềm riêngNhận việc, báo cáo ngay trong Telegram/ZaloBạn duyệt ai được nhắn cho Agent
LịchTự nhớ, tự nhắc mỗi ngàyChạy đúng giờ, gửi kết quảBạn xem lịch nào đang chạy

Tin nhắn mẫu để kiểm tra nhanh một Agent:

Tin nhắn TelegramCopy rồi dán vào khung chat với bot
Hãy tự kiểm tra và báo tôi ngắn gọn:
1. Bạn đang dùng model nào?
2. Bạn đang nhớ những quy tắc gì về công việc của tôi?
3. Bạn có những công cụ và kỹ năng nào?
4. Bạn đang có lịch tự chạy nào?
Chỉ báo cáo, không thay đổi gì.

Giới hạn và rủi ro theo từng bộ phận

Cách kiểm soát từng rủi ro: Rủi ro khi dùng AI Agent và cách kiểm soát.

Bắt đầu từ đâu?

  1. Viết sổ tay trước: vai trò, giọng văn, việc được tự làm, việc phải chờ duyệt.
  2. Lắp đủ 5 bộ phận ở mức tối thiểu: một model có hạn mức chi phí, một bot Telegram chỉ bạn nhắn được, công cụ chỉ đọc, một lịch báo cáo mỗi sáng. Làm theo hướng dẫn cài OpenClaw hoặc hướng dẫn cài Hermes.
  3. Sau 1–2 tuần, nâng từng bộ phận: thêm kỹ năng, thêm công cụ có quyền ghi kèm cổng duyệt, rồi mới mở kênh cho khách.

Đọc tiếp: 10 việc Agent làm thay →

Câu hỏi thường gặp

Bộ phận nào của AI Agent quan trọng nhất?

Cả năm đều cần, nhưng với doanh nghiệp, "sổ tay" thường quyết định chất lượng: model mạnh mà không biết sản phẩm, giọng văn, quy tắc duyệt của bạn thì vẫn làm sai ý. Bộ phận rủi ro nhất là "đôi tay", vì quyền càng rộng thì sai càng tốn kém.

Có thể dùng model của OpenAI, Anthropic hay Google làm bộ não cho OpenClaw, Hermes không?

Được. Cả hai cho phép chọn nhà cung cấp model và đổi model sau này mà không phải dựng lại Agent. Bạn trả tiền model trực tiếp cho nhà cung cấp theo lượng dùng, hoặc chạy model trên máy riêng nếu có phần cứng phù hợp.

Trí nhớ của Agent nằm ở đâu?

Với OpenClaw và Hermes, file trí nhớ nằm trên máy bạn cài (thư mục làm việc của OpenClaw, thư mục ~/.hermes của Hermes). Tuy vậy, mỗi lần Agent làm việc, phần trí nhớ liên quan được gửi tới nhà cung cấp model để xử lý, nên không ghi mật khẩu hay dữ liệu nhạy cảm vào sổ tay.

Kỹ năng (skill) khác công cụ thế nào?

Công cụ là khả năng làm một thao tác: đọc file, tìm web, gửi tin. Kỹ năng là bản hướng dẫn nghiệp vụ dạy Agent phối hợp các công cụ để làm một việc theo đúng cách của bạn, ví dụ quy trình làm báo cáo quảng cáo.

Tài liệu liên quan

Xem tất cả tài liệu hướng dẫn →

Bước tiếp theo

Đăng ký nhận lịch workshop AI Agent

Aduca tổ chức buổi workshop thực hành AI Agent cho chủ doanh nghiệp và đội Marketing – Sales. Để lại thông tin để được báo lịch gần nhất.

Về AducaChuỗi bài do đội ngũ Aduca biên soạn từ kinh nghiệm đào tạo và triển khai AI Agent cho Marketing – Sales. Aduca Academy do Nguyễn Đức – Chủ tịch Aduca Group sáng lập; ông kinh doanh thương mại điện tử từ 2012, chạy quảng cáo Facebook từ 2014 và đào tạo từ 2016. Phần thực hành từng bước nằm trong thư mục OpenClaw và thư mục Hermes Agent.

Nguồn tham khảo

Lịch sử cập nhật

Miễn trừ trách nhiệm

Bài viết thuộc chuỗi kiến thức của Công ty Cổ phần Giáo dục Aduca, chia sẻ miễn phí cho mục đích học tập. Thông tin kỹ thuật đối chiếu với tài liệu chính thức của các dự án và nền tảng tại ngày cập nhật (có ghi nguồn); phần nhận định là quan điểm của Aduca. OpenClaw, Hermes Agent và các phần mềm, dịch vụ nêu trong bài thuộc về chủ sở hữu tương ứng, không thuộc Aduca, và có thể thay đổi bất cứ lúc nào. Kết quả áp dụng phụ thuộc quy trình, dữ liệu và con người của từng doanh nghiệp; bài viết không cam kết doanh thu hay hiệu quả cụ thể. © 2026 Aduca — được trích dẫn khi ghi rõ nguồn aduca.vn.