Claude Skill MartKhám phá skillCâu dùng ngayHọc qua videoDùng terminalSkill là gì?
Về danh sách

Tạo ảnh bằng AI (OpenRouter)

Kỹ năng tạo và chỉnh sửa ảnh qua OpenRouter Image API, dùng chung một cú pháp cho Gemini, Seedream, Recraft, GPT-Image và hơn 30 mô hình khác.

Ảnh · VideoTrung cấp33,0303,248Điểm AI 10/10Cập nhật lần cuối: 9 thg 8, 2026

Kỹ năng này làm gì

  • Gọi OpenRouter Image API (POST /api/v1/images) qua script kèm theo scripts/generate_image.py để tạo ảnh chân thực, tranh minh họa, concept art, logo (kể cả SVG vector).
  • Chỉnh sửa và ghép ảnh từ ảnh tham chiếu bằng -i (đường dẫn cục bộ, URL HTTP(S) hoặc data URL, có thể dùng nhiều lần).
  • Kiểm tra trước (preflight) các tham số riêng của từng mô hình (--resolution, --aspect-ratio, --seed, --background, --n) so với danh mục trực tiếp trước khi bị tính phí, và in ra các giá trị hợp lệ nếu sai.
  • --list-models, --model-info, --dry-run hoàn toàn miễn phí; sau mỗi lần chạy script in chi phí thực tế.
  • Hướng dẫn viết prompt theo 5 yếu tố (chủ thể, chất liệu/phong cách, ánh sáng/màu, bố cục, điều cần tránh), bảng chọn mô hình, so sánh giá và cảnh báo khi dùng ảnh AI trong bài báo khoa học.

Phù hợp với ai

  • Người làm slide, poster, nội dung marketing cần hình ảnh riêng.
  • Designer/marketer muốn thử nhiều mô hình và lặp bản nháp với chi phí thấp.
  • Nhà nghiên cứu cần hình minh họa khái niệm nhưng phải ghi rõ đó là illustration, không phải dữ liệu.

Ví dụ sử dụng

  1. Ảnh hero khổ rộng cho poster: --aspect-ratio 21:9 --resolution 2K, chừa khoảng trống bên phải để đặt tiêu đề.
  2. Sửa ảnh có sẵn: "Make the sky purple" -i photo.jpg -o edited.png — chỉ mô tả phần muốn đổi.
  3. Logo vector với -m recraft/recraft-v4.1-vector, hoặc nền slide trong suốt với openai/gpt-image-1 --background transparent.
  4. Trước khi tạo ảnh 4K đắt tiền, chạy --dry-run để xem body request và xác thực tham số mà không mất phí.

· · · Hướng dẫn cài đặt · · ·

Dùng thử ngay, không cần cài

Dán đoạn dưới vào Claude là dùng được skill này mà không cần cài đặt.

Hãy đọc hướng dẫn trong tệp này và làm theo để giúp mình:
https://raw.githubusercontent.com/K-Dense-AI/scientific-agent-skills/HEAD/skills/generate-image/SKILL.md

Mình muốn: (viết việc bạn cần ở đây)

Nếu Claude không mở được liên kết, hãy mở liên kết và copy nội dung vào rồi dán.

Thấy hữu ích thì tải ZIP bên dưới và cài. Sau đó skill tự chạy, không phải dán lại mỗi lần.

Cài vào ứng dụng Claude (không cần terminal)
  1. Tải tệp ZIP bằng nút bên dưới.
  2. Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
  3. Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
Tải ZIP
Cài vào Claude Code

Để Claude làm — dán câu dưới đây vào Claude Code

Hãy cài skill mình tìm thấy trên Claude Skill Mart.
Copy thư mục skills/generate-image từ repo GitHub K-Dense-AI/scientific-agent-skills vào ~/.claude/skills/generate-image/ của mình.
Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.

Cài bằng lệnh thủ công

git clone https://github.com/K-Dense-AI/scientific-agent-skills.git /tmp/sas && cp -r /tmp/sas/skills/generate-image ~/.claude/skills/generate-image

Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.

  1. Mở terminal và tải repo: git clone https://github.com/K-Dense-AI/scientific-agent-skills.git
  2. Chép thư mục kỹ năng vào Claude Code: mkdir -p ~/.claude/skills && cp -r scientific-agent-skills/skills/generate-image ~/.claude/skills/
  3. Kiểm tra Python 3.9 trở lên: python3 --version (script chỉ dùng thư viện chuẩn, không cần cài thêm gói).
  4. Lấy API key tại https://openrouter.ai/keys và nạp credit (mỗi ảnh đều tốn phí).
  5. Đặt biến môi trường: export OPENROUTER_API_KEY=sk-or-... hoặc tạo file .env chứa OPENROUTER_API_KEY=... và thêm .env vào .gitignore.
  6. Thử lệnh miễn phí để kiểm tra: python3 ~/.claude/skills/generate-image/scripts/generate_image.py --list-models gemini
  7. Khởi động lại Claude Code, rồi yêu cầu ví dụ "tạo ảnh hoàng hôn trên núi". Luôn mở file kết quả để kiểm tra bố cục và chữ trong ảnh.