Tạo và chỉnh sửa ảnh bằng hơn 30 model (Gemini, Seedream, Recraft, GPT-Image, Riverflow) qua một API duy nhất của OpenRouter.
Skill chính thức giúp tạo và kiểm tra ảnh GIF động đúng chuẩn emoji và tin nhắn Slack.
Mô tả bằng ngôn ngữ tự nhiên để tạo sơ đồ khoa học chất lượng xuất bản, kèm bước AI tự chấm điểm và tinh chỉnh.
Chỉ cần mô tả nội dung, AI sẽ tạo infographic chất lượng xuất bản và tự tinh chỉnh đến khi đạt ngưỡng chất lượng.
Chỉ cần đưa danh sách lệnh, skill sẽ dùng VHS ghi lại terminal và xuất ra ảnh GIF động sẵn dùng cho README.
Chuyển file ghi âm hoặc video thành văn bản kèm nhãn người nói và mốc thời gian, đồng thời xử lý tiền xử lý audio cho ASR.
Biến một chủ đề hoặc bài viết thành truyện tranh giáo dục hoàn chỉnh, có storyboard, nhân vật nhất quán và file PDF cuối.
Skill tự thiết kế và tạo ảnh bìa cho bài viết dựa trên 5 chiều tuỳ biến: kiểu, bảng màu, phong cách vẽ, chữ và tâm trạng.
Phân tích bài viết, chọn đúng vị trí cần hình minh họa và tạo ảnh đồng bộ theo bộ ba Type × Style × Palette rồi chèn vào bài.
Tạo infographic chất lượng xuất bản bằng cách kết hợp 21 kiểu layout với 22 phong cách hình ảnh.
Skill tạo ảnh AI đa nhà cung cấp, gộp OpenAI, Google, DashScope, MiniMax… vào một câu lệnh duy nhất.
Biến một bài viết dài thành bộ 1–10 ảnh card infographic cho mạng xã hội với 12 style, 8 layout và 3 bảng màu.
Tạo giọng nói tiếng Trung/Nhật giàu cảm xúc bằng stepaudio-2.5-tts của StepFun thông qua hướng dẫn bằng ngôn ngữ tự nhiên và chỉ dẫn trong ngoặc đơn.
Chuyển audio dài tới 30 phút thành văn bản chỉ trong một lần gọi API bằng mô hình stepaudio-2.5-asr của StepFun.
Tải video/âm thanh YouTube và luồng HLS (m3u8) ở chất lượng cao một cách ổn định bằng yt-dlp và ffmpeg.
So sánh hai video và tạo báo cáo HTML tương tác với chỉ số PSNR/SSIM cùng đối chiếu từng khung hình.
Skill CLI dùng API Gemini Web (bị dịch ngược) để tạo văn bản, tạo ảnh, nhận ảnh tham chiếu và hội thoại nhiều lượt.