Checklist kiểm định benchmark
Bộ 7 câu hỏi buộc kiểm chứng số đo hiệu năng bằng bằng chứng thực tế trước khi báo cáo hay ra quyết định.
Lập trìnhTrung cấp★ 969⑂ 112Điểm AI 9/10Cập nhật lần cuối: 3 thg 10, 2026
Làm được gì
Trước khi bạn công bố một con số hiệu năng (before/after trong PR, cáo buộc regression, chọn thư viện hay cấu hình), skill buộc Claude "tra hỏi" chính phép đo đó.
- Chuẩn bị trước khi chạy: viết ra tuyên bố dự kiến đúng như lúc sẽ công bố, đọc script đo để biết nó tính gì và bỏ qua gì, kiểm tra tải máy bằng
uptimevà số core bằngnproc. - 7 câu hỏi: ① điểm nghẽn (limiter) là gì ② hai bên có được tune như production chưa ③ có vượt giới hạn vật lý không (băng thông đĩa/mạng, số core) ④ có đếm lỗi và phản hồi thất bại chưa ⑤ có tái lập được không (chạy xen kẽ A,B,A,B ít nhất 5 lần, báo trung vị và khoảng) ⑥ có ý nghĩa với đường đi end-to-end mà người dùng chờ không ⑦ công việc có thực sự xảy ra trong vùng được bấm giờ không.
- Cách báo cáo: nêu kết luận trước (nhanh hơn / chậm hơn / không khác biệt đo được / không kết luận được), kèm đơn vị, số lần chạy, khoảng dao động và điểm nghẽn.
Phù hợp với ai
- Dev backend/hạ tầng thường gắn số liệu hiệu năng vào PR
- Nhóm điều tra regression hoặc so sánh thư viện, cấu hình
- Người muốn chặn các tuyên bố "đã tối ưu xong" thiếu bằng chứng từ AI
Ví dụ sử dụng
- "Đổi JSON parser giúp export nhanh 30%" → phát hiện parser chỉ chiếm 1% request nên tác động thực tế gần như bằng 0.
- So sánh hai ORM → chỉ ra một bên chạy debug build và commit từng dòng, nên đó là so cấu hình chứ không phải so code; yêu cầu đo lại.
- Con số vượt băng thông đĩa → kết luận ngay là cache hoặc no-op, công việc chưa từng thực sự chạy.
· · · Hướng dẫn cài đặt · · ·
Dùng thử ngay, không cần cài
Dán đoạn dưới vào Claude là dùng được skill này mà không cần cài đặt.
Hãy đọc hướng dẫn trong tệp này và làm theo để giúp mình: https://raw.githubusercontent.com/michael-denyer/pstack-claude/HEAD/plugins/pstack/skills/benchmark-checklist/SKILL.md Mình muốn: (viết việc bạn cần ở đây)
Nếu Claude không mở được liên kết, hãy mở liên kết và copy nội dung vào rồi dán.
↓ Thấy hữu ích thì tải ZIP bên dưới và cài. Sau đó skill tự chạy, không phải dán lại mỗi lần.
Cài vào ứng dụng Claude (không cần terminal)
- Tải tệp ZIP bằng nút bên dưới.
- Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
- Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
Cài vào Claude Code
Để Claude làm — dán câu dưới đây vào Claude Code
Hãy cài skill mình tìm thấy trên Claude Skill Mart. Copy thư mục plugins/pstack/skills/benchmark-checklist từ repo GitHub michael-denyer/pstack-claude vào ~/.claude/skills/benchmark-checklist/ của mình. Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.
Cài bằng lệnh thủ công
git clone https://github.com/michael-denyer/pstack-claude.git /tmp/pstack-claude && mkdir -p ~/.claude/skills && cp -r /tmp/pstack-claude/plugins/pstack/skills/benchmark-checklist ~/.claude/skills/⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.
- Mở terminal.
- Clone repo:
git clone https://github.com/michael-denyer/pstack-claude.git - Tạo thư mục skill:
mkdir -p ~/.claude/skills - Copy skill:
cp -r pstack-claude/plugins/pstack/skills/benchmark-checklist ~/.claude/skills/ - (Khuyến nghị) Copy toàn bộ để có các playbook liên quan:
cp -r pstack-claude/plugins/pstack/skills/* ~/.claude/skills/ - Khởi động lại Claude Code, rồi nói ví dụ: "Mình vừa chạy benchmark, kiểm định kết quả giúp mình".
- Cài sẵn
perf,py-spy,strace,pidstatđể trả lời được các câu hỏi về profiling.
Xem mã nguồn trên GitHub ↗Giấy phép: MIT