Claude Skill MartKhám phá skillCâu dùng ngayHọc qua videoDùng terminalSkill là gì?
← Về danh sách

Agent Routing (chọn model, mức effort và cascade)

Quyết định model, mức effort và hình dạng cascade cho từng subagent dựa trên chi phí thực đo cho mỗi tác vụ hoàn thành.

Tự động hóaNâng cao★ 150⑂ 6Điểm AI 9/10Cập nhật lần cuối: 2 thg 10, 2026

Làm được gì

  • Bảng định tuyến theo hình dạng tác vụ: chỉ cần hai câu hỏi — output ngắn hay dài, kiểm tra máy được hay cần phán đoán — để chọn haiku@low, sonnet@medium hay opus@high.
  • Định tuyến theo chi phí mỗi tác vụ hoàn thành, không theo giá mỗi token: chứng minh bằng số rằng tier rẻ có thể phát ra 6–7× token và cuối cùng đắt hơn.
  • Quy tắc thiết kế cascade: kiểm tra trước xem tier rẻ có thực sự rẻ hơn không; không có verifier thì không dùng cascade; quyết định leo thang thuộc về orchestrator giữ verifier, không phải worker.
  • Đòn "concision" giúp giảm 27–37% output cho tác vụ sinh nội dung dài, kèm cảnh báo giới hạn: nén tư duy quá mức làm sập tỷ lệ pass.
  • Checklist bàn giao ngữ cảnh: subagent không thừa hưởng gì, nên phải nhồi vào prompt đường dẫn artifact, câu lệnh nguyên văn (kể cả path interpreter), anti-pattern và spec output.
  • Kỷ luật vòng lặp (bắt buộc có evaluator ngoài, chọn bản điểm cao nhất, dừng ngay khi tụt điểm) và cách theo dõi fan-out theo thời gian thực qua stream từng thread.

Dành cho ai

  • Người dùng Claude Code / Claude Code on the Web chạy nhiều subagent qua Agent/Workflow tools
  • Nhóm đang bị đội chi phí API trong pipeline agent và cần biết nguyên nhân
  • Kiến trúc sư orchestration muốn có chính sách chọn tier dựa trên số liệu thay vì cảm tính
  • (Không áp dụng cho việc chat trên claude.ai)

Ví dụ sử dụng

  1. Fan-out 100 tác vụ trích xuất JSON: output ngắn và kiểm tra máy được → dùng haiku@low + kiểm tra schema, tránh thói quen "nâng model cho chắc" vốn đắt 3–5× mà không lợi ích đo được.
  2. Sinh module từ spec: chạy rung 1 sonnet@low + concision; nếu test fail thì retry cùng model ở medium, kèm patch trước và log test lỗi — rẻ hơn và đúng hơn việc nhảy sang opus.
  3. 4 agent khảo sát repo 2.300 file: đưa sẵn slice của symbol index, câu lệnh nguyên văn và luật "không dùng ls/glob để khám phá", nhờ đó chi phí mò mẫm về gần bằng 0.

· · · Hướng dẫn cài đặt · · ·

Dùng thử ngay, không cần cài

Dán đoạn dưới vào Claude là dùng được skill này mà không cần cài đặt.

Hãy đọc hướng dẫn trong tệp này và làm theo để giúp mình:
https://raw.githubusercontent.com/oaustegard/claude-skills/HEAD/agent-routing/SKILL.md

Mình muốn: (viết việc bạn cần ở đây)

Nếu Claude không mở được liên kết, hãy mở liên kết và copy nội dung vào rồi dán.

↓ Thấy hữu ích thì tải ZIP bên dưới và cài. Sau đó skill tự chạy, không phải dán lại mỗi lần.

Cài vào ứng dụng Claude (không cần terminal)
  1. Tải tệp ZIP bằng nút bên dưới.
  2. Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
  3. Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
↓ Tải ZIP
Cài vào Claude Code

Để Claude làm — dán câu dưới đây vào Claude Code

Hãy cài skill mình tìm thấy trên Claude Skill Mart.
Copy thư mục agent-routing từ repo GitHub oaustegard/claude-skills vào ~/.claude/skills/agent-routing/ của mình.
Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.

Cài bằng lệnh thủ công

git clone https://github.com/oaustegard/claude-skills.git && mkdir -p ~/.claude/skills && cp -r claude-skills/agent-routing ~/.claude/skills/

⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.

  1. Mở terminal và tạo thư mục skills: mkdir -p ~/.claude/skills
  2. Clone repo: git clone https://github.com/oaustegard/claude-skills.git
  3. Copy đúng skill này: cp -r claude-skills/agent-routing ~/.claude/skills/
  4. Kiểm tra ~/.claude/skills/agent-routing/SKILL.md và thư mục references/ đã được copy kèm (đó là tài liệu số liệu tham chiếu).
  5. Khởi động lại Claude Code và xác nhận agent-routing xuất hiện trong danh sách skill.
  6. Kích hoạt bằng cách hỏi "tác vụ này nên dùng model/effort nào?" hoặc khi yêu cầu spawn nhiều subagent.
  7. Lưu ý: các con số giá và token trong tài liệu gắn với thời điểm đo; nếu model hoặc bảng giá đã đổi, hãy tự đo lại thay vì tin nguyên bảng.