compare — So sánh run huấn luyện cùng epoch
Kỹ năng so sánh các lần chạy huấn luyện trên wandb/neptune/mlflow/tensorboard bằng cách căn chỉnh chúng tại cùng một bước huấn luyện.
Dữ liệu · Phân tíchTrung cấp★ 361⑂ 31Điểm AI 9/10Cập nhật lần cuối: 3 thg 7, 2026
Làm được gì
- Tự phát hiện hệ thống theo dõi thí nghiệm qua biến môi trường hoặc thư mục (wandb, neptune, mlflow, tensorboard, file JSON cục bộ).
- Lấy toàn bộ lịch sử metric, không chỉ giá trị cuối cùng.
- Xác định bước hiện tại của run đang chạy rồi cắt baseline tại đúng bước đó, tránh lỗi so sánh epoch 11 với epoch 100.
- Tách metric proxy (kNN, loss) khỏi metric downstream (linear probe, F1) và báo cáo riêng trong một bảng gọn.
- Bắt buộc dùng tên run đầy đủ, cảnh báo về so sánh một seed hay metric ghi khác nhau.
Phù hợp với ai
- Nhà nghiên cứu / kỹ sư ML chạy nhiều thí nghiệm song song và theo dõi khoảng cách với baseline
- Nghiên cứu sinh cần lập bảng so sánh thí nghiệm cho báo cáo, bài báo
- Người phụ trách thí nghiệm hay bị hỏi "run này đang thắng hay thua?"
Ví dụ sử dụng
- "Run fastvit đang chạy có đuổi kịp baseline conv không?" → lấy lịch sử hai run, cắt tại epoch hiện tại và in bảng delta.
- "Xếp hạng 5 thí nghiệm trong sweep này" → căn chỉnh cùng bước, tách proxy/downstream, ghi chú nếu chỉ một seed.
- "Run của tôi hội tụ chưa?" → trình bày 5 epoch cuối của đường cong thay vì kết luận vội.
· · · Hướng dẫn cài đặt · · ·
Dùng thử ngay, không cần cài
Dán đoạn dưới vào Claude là dùng được skill này mà không cần cài đặt.
Hãy đọc hướng dẫn trong tệp này và làm theo để giúp mình: https://raw.githubusercontent.com/fcakyon/phd-skills/HEAD/plugin/skills/compare/SKILL.md Mình muốn: (viết việc bạn cần ở đây)
Nếu Claude không mở được liên kết, hãy mở liên kết và copy nội dung vào rồi dán.
↓ Thấy hữu ích thì tải ZIP bên dưới và cài. Sau đó skill tự chạy, không phải dán lại mỗi lần.
Cài vào ứng dụng Claude (không cần terminal)
- Tải tệp ZIP bằng nút bên dưới.
- Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
- Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
Cài vào Claude Code
Để Claude làm — dán câu dưới đây vào Claude Code
Hãy cài skill mình tìm thấy trên Claude Skill Mart. Copy thư mục plugin/skills/compare từ repo GitHub fcakyon/phd-skills vào ~/.claude/skills/compare/ của mình. Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.
Cài bằng lệnh thủ công
git clone https://github.com/fcakyon/phd-skills.git && mkdir -p ~/.claude/skills && cp -r phd-skills/plugin/skills/compare ~/.claude/skills/⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.
- Mở terminal.
- Tải mã nguồn:
git clone https://github.com/fcakyon/phd-skills.git - Tạo thư mục kỹ năng:
mkdir -p ~/.claude/skills - Sao chép kỹ năng:
cp -r phd-skills/plugin/skills/compare ~/.claude/skills/ - Khởi động lại Claude Code, sau đó yêu cầu ví dụ: "so sánh run wandb của tôi với baseline".
- Chuẩn bị trước: đặt biến môi trường xác thực (
WANDB_API_KEY,NEPTUNE_API_TOKEN,MLFLOW_TRACKING_URI) và cài thư viện Python tương ứng.
Xem mã nguồn trên GitHub ↗Giấy phép: MIT