mediagen
让 AI 编程助手一键生成图片和视频,支持 Gemini、OpenAI、Kie AI 三大平台
mediagen 是一个面向 AI 编程助手的图片与视频生成 Skill,支持 Google Gemini、OpenAI 和 Kie AI 三大平台。只需用自然语言描述需求,Agent 就能自动选择合适的模型、比例、分辨率,生成高质量视觉内容。
核心能力
支持图片生成、图片编辑和视频生成三大任务。通过自然语言指令即可调用,Agent 会自动处理:选择最合适的 provider 和模型(如 Gemini 处理 21:9 宽屏和视频,OpenAI 不支持 16:9),将模糊描述扩展为完整提示词(含主体、构图、光线、材质等要素),并在生成后自动为内容打上 AI 生成标签。
支持模型
图片:Google Gemini(支持多种尺寸和 21:9 宽屏)、OpenAI DALL-E、Kie AI(聚合约 30 个第三方模型)。视频:目前仅 Gemini 支持。
使用方式
安装后对 Agent 说「帮我做一张产品的落地页大图,宽屏、氛围感强」,Agent 会自动调用 mediagen image 命令,生成符合要求的图片。整个过程无需人工干预 API key 配置,Skill 会引导完成初始化。
特点
一个 Skill 同时覆盖三大 AI 平台,Agent 自动匹配合适模型;内置提示词优化逻辑,避免生成简陋或风格不对的内容;支持 AI 内容标记,方便遵守欧盟 AI 法案等合规要求。
团队信息
AI产品库
官方
由 AI 猎手自动发现
评论与建议
登录 后参与评论或提建议