Trình sửa lỗi bản ghi (Transcript Fixer)
Sửa lỗi nhận dạng giọng nói (STT) theo hai bước — từ điển tự động rồi AI nội bộ của Claude — và ghi nhớ từng lần sửa để lần sau tự động đúng.
Nội dung · Viết láchNâng cao★ 1,323⑂ 212Điểm AI 8/10Cập nhật lần cuối: 8 thg 8, 2026
Làm được gì
- Bước 1 – Từ điển: dùng các quy tắc đã lưu trong
~/.transcript-fixer/corrections.dbđể sửa ngay lập tức, miễn phí những lỗi lặp lại (tên sản phẩm, tên người, từ đồng âm hay sai). Chế độ an toàn là mặc định: các thay thế rủi ro cao được đưa sang*_needs_review.mdthay vì áp dụng âm thầm. - Bước 2 – AI nội bộ của Claude: không cần API key ngoài, Claude tự đọc bản ghi sau bước 1 và sửa các danh từ riêng, thuật ngữ chuyên ngành, từ đồng âm phụ thuộc ngữ cảnh. Đây mới là bước xử lý phần lớn lỗi thật.
- Học tích luỹ: các bản sửa đã xác nhận được
--addvào từ điển theo domain; mẫu lặp lại được đề xuất qua--review-learnedvà duyệt bằng--approve. Mục chưa chắc được đưa vào hàng đợi review để quyết định sau. - An toàn: xem trước bằng
--dry-run, báo cáo thay đổi, báo lỗi sai--report-false-positive, kiểm tra quy tắc rủi ro--audit, dò tần suất thực tế trong corpus--probe. - Tự động hoá: môi trường CI không có Claude Code có thể dùng chế độ Stage 3 qua GLM API.
Phù hợp với ai
- Người thường xuyên biên tập biên bản họp, phỏng vấn, bản ghi bài giảng
- Người dùng Whisper/Otter/công cụ họp nội bộ muốn biến bản ghi thô thành tài liệu sạch
- Nhóm có nhiều tên riêng nội bộ (sản phẩm, đồng nghiệp) bị nhận dạng sai lặp lại
- Lập trình viên muốn dựng pipeline xử lý hàng loạt bản ghi
Ví dụ sử dụng
- Biên bản họp hàng tuần: chạy
--stage 1, sau đó để Claude đọc và sửa phần còn lại, rồi--add ... --domain myprojectcho các lỗi sẽ còn lặp lại. - Xử lý loạt bản ghi bài giảng: dùng vòng lặp shell cho cả thư mục, đọc dòng
--jsonđể biết số bản sửa đã áp dụng và số bị hoãn, chỉ xem tay phần bị hoãn. - Chuẩn hoá tên người: đăng ký các biến thể STT của những người xuất hiện thường xuyên vào people roster để mọi bản ghi sau đều ghi đúng tên.
· · · Hướng dẫn cài đặt · · ·
Cài vào ứng dụng Claude (không cần terminal)
- Tải tệp ZIP bằng nút bên dưới.
- Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
- Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
Cài vào Claude Code
Để Claude làm — dán câu dưới đây vào Claude Code
Hãy cài skill mình tìm thấy trên Claude Skill Mart. Copy thư mục daymade-audio/transcript-fixer từ repo GitHub daymade/claude-code-skills vào ~/.claude/skills/transcript-fixer/ của mình. Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.
Cài bằng lệnh thủ công
git clone https://github.com/daymade/claude-code-skills.git && mkdir -p ~/.claude/skills && cp -r claude-code-skills/daymade-audio/transcript-fixer ~/.claude/skills/⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.
- Cài uv: các script chạy bằng uv (metadata PEP 723). Trên macOS/Linux:
curl -LsSf https://astral.sh/uv/install.sh | sh. - Clone repo:
git clone https://github.com/daymade/claude-code-skills.git - Copy skill:
mkdir -p ~/.claude/skills && cp -r claude-code-skills/daymade-audio/transcript-fixer ~/.claude/skills/ - Khởi tạo cơ sở dữ liệu:
cd ~/.claude/skills/transcript-fixer && uv run scripts/fix_transcription.py --init - Khởi động lại Claude Code, rồi yêu cầu ví dụ: "sửa lỗi nhận dạng trong bản ghi này".
- (Tuỳ chọn) Nạp bộ quy tắc sẵn:
uv run scripts/fix_transcription.py --load-presets tech - (Tuỳ chọn) Nếu cần chạy tự động ngoài Claude Code:
export GLM_API_KEY="..."rồi dùng chế độ--stage 3. Trong Claude Code thì không nên dùng Stage 3.
Xem mã nguồn trên GitHub ↗Giấy phép: MIT