Tạo ảnh AI (OpenRouter)
Tạo và chỉnh sửa ảnh bằng hơn 30 model (Gemini, Seedream, Recraft, GPT-Image, Riverflow) qua một API duy nhất của OpenRouter.
Ảnh · VideoTrung cấp★ 33,030⑂ 3,248Điểm AI 9/10Cập nhật lần cuối: 9 thg 8, 2026
Làm được gì
Skill đóng gói một script Python gọi tới OpenRouter Image API (POST /api/v1/images) để tạo ảnh chụp thực tế, tranh minh họa, concept art, logo vector (SVG), ảnh nền trong suốt, cũng như chỉnh sửa và ghép ảnh từ ảnh tham chiếu.
- Gọi hơn 30 model (Gemini 3.x, Seedream 4.5, Recraft v4.1, GPT-Image, Riverflow…) với cùng một cú pháp
- Kiểm tra tham số trước khi bị tính phí: mỗi model chấp nhận bộ tham số và giá trị khác nhau (
--aspect-ratio,--resolution,--seed,--background,--n), script báo lỗi cục bộ trong dưới 1 giây kèm danh sách giá trị hợp lệ --dry-runin ra đúng body request mà không tạo ảnh;--list-models,--model-infotra danh mục và giá miễn phí-inhận đường dẫn cục bộ, URL hoặc data URL, lặp lại được để ghép nhiều ảnh tham chiếu- In chi phí thực tế sau mỗi lần chạy, kèm cảnh báo về việc model viết chữ sai và về đạo đức khoa học (ảnh sinh ra là minh họa, không phải dữ liệu)
Với sơ đồ kỹ thuật (flowchart, mạch điện, pathway sinh học) tài liệu khuyên dùng skill scientific-schematics thay thế.
Phù hợp với ai
- Nhà nghiên cứu, người làm slide, poster, nội dung marketing cần hình ảnh nhanh
- Lập trình viên muốn so sánh nhiều model ảnh và tối ưu chi phí
- Designer cần đầu ra vector (logo, icon) hoặc nền trong suốt cho slide
- Người muốn kiểm soát chi phí API: nháp bằng model rẻ, render cuối bằng model cao cấp
Ví dụ sử dụng
- Ảnh bìa poster khổ rộng: "Phòng thí nghiệm thiết bị hiện đại, ảnh thực tế, wide shot, chừa khoảng trống bên phải cho tiêu đề, không có chữ" với
--aspect-ratio 21:9 --resolution 2K - Logo vector:
-m recraft/recraft-v4.1-vector -o assets/logo.svgđể nhận file SVG thật sự thay vì ảnh raster - Chỉnh sửa ảnh:
"Thêm kính râm cho người trong ảnh" -i portrait.png, hoặc trộn hai phong cách-i style_a.png -i style_b.jpg - Chạy thử miễn phí: thêm
--dry-runđể xác nhận request 4K trước khi thực sự trả phí
· · · Hướng dẫn cài đặt · · ·
Cài vào ứng dụng Claude (không cần terminal)
- Tải tệp ZIP bằng nút bên dưới.
- Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
- Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
Cài vào Claude Code
Để Claude làm — dán câu dưới đây vào Claude Code
Hãy cài skill mình tìm thấy trên Claude Skill Mart. Copy thư mục skills/generate-image từ repo GitHub K-Dense-AI/scientific-agent-skills vào ~/.claude/skills/generate-image/ của mình. Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.
Cài bằng lệnh thủ công
git clone https://github.com/K-Dense-AI/scientific-agent-skills.git /tmp/sas && mkdir -p ~/.claude/skills && cp -r /tmp/sas/skills/generate-image ~/.claude/skills/⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.
- Kiểm tra Python 3.9 trở lên:
python3 --version(script chỉ dùng thư viện chuẩn). - Tải repo:
git clone https://github.com/K-Dense-AI/scientific-agent-skills.git - Sao chép skill vào thư mục skill của Claude Code:
mkdir -p ~/.claude/skills && cp -r scientific-agent-skills/skills/generate-image ~/.claude/skills/ - Lấy API key tại https://openrouter.ai/keys và nạp credit (việc tạo ảnh có phí).
- Khai báo biến môi trường:
export OPENROUTER_API_KEY=sk-or-...hoặc tạo file.envchứa dòngOPENROUTER_API_KEY=...và nhớ thêm.envvào.gitignore. - Kiểm tra bằng lệnh không tốn phí:
python ~/.claude/skills/generate-image/scripts/generate_image.py --list-models - Khởi động lại Claude Code, rồi yêu cầu ví dụ: "Tạo cho tôi ảnh mặt trời lặn trên dãy núi".
- Khi mới dùng, hãy thử
--dry-runhoặc model rẻgoogle/gemini-3.1-flash-lite-imageđể tinh chỉnh prompt trước khi render bản cuối ở độ phân giải cao.
Xem mã nguồn trên GitHub ↗Giấy phép: MIT