Claude Skill MartKhám phá skillCâu dùng ngayHọc qua videoDùng terminalSkill là gì?
← Về danh sách

Checklist kiểm định benchmark

Bộ 7 câu hỏi buộc kiểm chứng số đo hiệu năng bằng bằng chứng thực tế trước khi báo cáo hay ra quyết định.

Lập trìnhTrung cấp★ 969⑂ 112Điểm AI 9/10Cập nhật lần cuối: 3 thg 10, 2026

Làm được gì

Trước khi bạn công bố một con số hiệu năng (before/after trong PR, cáo buộc regression, chọn thư viện hay cấu hình), skill buộc Claude "tra hỏi" chính phép đo đó.

  • Chuẩn bị trước khi chạy: viết ra tuyên bố dự kiến đúng như lúc sẽ công bố, đọc script đo để biết nó tính gì và bỏ qua gì, kiểm tra tải máy bằng uptime và số core bằng nproc.
  • 7 câu hỏi: ① điểm nghẽn (limiter) là gì ② hai bên có được tune như production chưa ③ có vượt giới hạn vật lý không (băng thông đĩa/mạng, số core) ④ có đếm lỗi và phản hồi thất bại chưa ⑤ có tái lập được không (chạy xen kẽ A,B,A,B ít nhất 5 lần, báo trung vị và khoảng) ⑥ có ý nghĩa với đường đi end-to-end mà người dùng chờ không ⑦ công việc có thực sự xảy ra trong vùng được bấm giờ không.
  • Cách báo cáo: nêu kết luận trước (nhanh hơn / chậm hơn / không khác biệt đo được / không kết luận được), kèm đơn vị, số lần chạy, khoảng dao động và điểm nghẽn.

Phù hợp với ai

  • Dev backend/hạ tầng thường gắn số liệu hiệu năng vào PR
  • Nhóm điều tra regression hoặc so sánh thư viện, cấu hình
  • Người muốn chặn các tuyên bố "đã tối ưu xong" thiếu bằng chứng từ AI

Ví dụ sử dụng

  • "Đổi JSON parser giúp export nhanh 30%" → phát hiện parser chỉ chiếm 1% request nên tác động thực tế gần như bằng 0.
  • So sánh hai ORM → chỉ ra một bên chạy debug build và commit từng dòng, nên đó là so cấu hình chứ không phải so code; yêu cầu đo lại.
  • Con số vượt băng thông đĩa → kết luận ngay là cache hoặc no-op, công việc chưa từng thực sự chạy.

· · · Hướng dẫn cài đặt · · ·

Dùng thử ngay, không cần cài

Dán đoạn dưới vào Claude là dùng được skill này mà không cần cài đặt.

Hãy đọc hướng dẫn trong tệp này và làm theo để giúp mình:
https://raw.githubusercontent.com/michael-denyer/pstack-claude/HEAD/plugins/pstack/skills/benchmark-checklist/SKILL.md

Mình muốn: (viết việc bạn cần ở đây)

Nếu Claude không mở được liên kết, hãy mở liên kết và copy nội dung vào rồi dán.

↓ Thấy hữu ích thì tải ZIP bên dưới và cài. Sau đó skill tự chạy, không phải dán lại mỗi lần.

Cài vào ứng dụng Claude (không cần terminal)
  1. Tải tệp ZIP bằng nút bên dưới.
  2. Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
  3. Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
↓ Tải ZIP
Cài vào Claude Code

Để Claude làm — dán câu dưới đây vào Claude Code

Hãy cài skill mình tìm thấy trên Claude Skill Mart.
Copy thư mục plugins/pstack/skills/benchmark-checklist từ repo GitHub michael-denyer/pstack-claude vào ~/.claude/skills/benchmark-checklist/ của mình.
Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.

Cài bằng lệnh thủ công

git clone https://github.com/michael-denyer/pstack-claude.git /tmp/pstack-claude && mkdir -p ~/.claude/skills && cp -r /tmp/pstack-claude/plugins/pstack/skills/benchmark-checklist ~/.claude/skills/

⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.

  1. Mở terminal.
  2. Clone repo: git clone https://github.com/michael-denyer/pstack-claude.git
  3. Tạo thư mục skill: mkdir -p ~/.claude/skills
  4. Copy skill: cp -r pstack-claude/plugins/pstack/skills/benchmark-checklist ~/.claude/skills/
  5. (Khuyến nghị) Copy toàn bộ để có các playbook liên quan: cp -r pstack-claude/plugins/pstack/skills/* ~/.claude/skills/
  6. Khởi động lại Claude Code, rồi nói ví dụ: "Mình vừa chạy benchmark, kiểm định kết quả giúp mình".
  7. Cài sẵn perf, py-spy, strace, pidstat để trả lời được các câu hỏi về profiling.