guide清单19 分钟阅读

MiniMax H3 的 9 个 Skills:该选哪套工作流?

完整对比 MiniMax H3 的 9 个 Skills,涵盖提示词、产品广告、科普动画、MV 与实拍融合,帮你按创作边界选择工作流。

OmniArt 团队
MiniMax H3 的 9 个 Skills:该选哪套工作流?

官方仓库中的 9 个 MiniMax H3 Skills 并不是 9 套可以相互替换的提示词预设。其中一个负责把多模态创意需求整理成 H3 的结构化提示词格式,另外 8 个则分别组织特定类型的制作流程,覆盖产品广告、歌词驱动的 MV、纸艺科普和双人游戏片头等场景。

这一区别正是最快的选择依据。如果最终交付物是技术结构严谨的 H3 提示词,就用 h3-prompt-writing。如果还需要创意方向、源素材检查、确认节点、分镜、生成或合成,则应选择风格或工作流 Skill。本指南会梳理 MiniMax H3 官方 Skills 目录记录的全部 9 个包,重点解释每套流程从哪里开始、在哪里结束。

说明

MiniMax 表示这些 Skills 仍在持续维护和迭代。8 个风格 Skills 同时提供英文和中文文件, h3-prompt-writing 目前仅提供英文版。正式投入制作前,应先检查仓库中的最新内容。

9 个 MiniMax H3 Skills 一览

Skill适合选择的情况不适合的情况
h3-prompt-writing需要为 T2VA、I2VA、FL2VA、L2VA 或 Ref2VA 编写结构化 H3 提示词需要完整的创意制作流程
minimalist-product-ad-generator已有产品图,需要制作精致的电商或发布短片口播广告、通用剪辑或复杂屏幕演示
3d-animation-short-generator需要从头到尾制作剧情驱动的风格化 3D 短片单张图片、简单编辑、写实实拍或单个独立镜头
papercraft-stop-motion-explainer需要用分层纸艺场景讲解知识常规 2D 动画、线稿涂鸦或实拍
brand-promo-video-generator需要为品牌、App、网站、商店或项目制作有来源依据、不过度宣称的宣传片杜撰产品卖点、仿制未获授权的 Logo 或长篇叙事影片
music-video-subtitle-generator歌词、节奏、空间排版与连续镜头共同驱动画面字幕清理、通用剪辑或没有 MV 结构的简单短片
co-op-game-intro-generator需要带玩家名片的双人游戏菜单或开场动画可玩游戏开发、多页面 UI 或无角色的通用片头
paper-collage-explainer-generator需要用编辑式拼贴 B-roll 表达旁白、观点或抽象概念主播广告、可编辑图层、复杂排版或仅交付提示词
handdrawn-live-video-generator需要一段 15 秒实拍场景,并让粗粝发光手绘元素进入其中多场景剪辑、精致 CG、恐怖题材或毛绒角色质感

这张表是分流图,不是质量排名。多套 Skills 都可能涉及提示词、分镜、视频和音频,但它们各自守护的是不同的创作约定。

1. h3-prompt-writing:专攻提示词结构

当你已经明确场景,只需要按照 H3 预期的结构表达时,选择 h3-prompt-writing。它支持 5 种模式:文生音视频(T2VA)、首帧生音视频(I2VA)、首尾帧生音视频(FL2VA)、尾帧生音视频(L2VA)以及全参考 Ref2VA。

对于 4 种基础或关键帧模式,Skill 会遵循一份参考指南,并依次输出 integrated_multimodal_descriptionoverall_soundscapenon_diegetic_music。Ref2VA 使用另一套六段式指南,让图像、视频和音频参考素材都能获得清晰标签和明确任务。

创意决策已经锁定时,可以把它作为最后一层。如果你还要构思故事、核验品牌事实、设计视觉语言或确认画面,应先从下方某个制作 Skill 开始,等方案稳定后再整理提示词结构。

2. minimalist-product-ad-generator:以产品为核心的广告

这套 Skill 从产品图或相关素材开始,然后检查款式、提炼有依据的卖点并确认制作需求。它用 3 张独立的产品锚点图和一份精确的节拍文字分镜来控制视频,而不是把所有参考塞进一张多宫格图片。

如果产品本身必须始终是电商短片或发布影片的视觉核心,就选择它。这套流程还覆盖精简英文广告文案、摄影机指导、生成、科技感 BGM、卡点剪辑和交付审查。它刻意不在首次信息收集中讨论音乐,而是在后续环节单独处理。

关键边界是产品导向。创始人口播、复杂软件操作演示或开放式剪辑任务都不适合强行套用这条流程。

3. 3d-animation-short-generator:故事优先的动画短片

这套 Skill 面向完整的风格化 3D 叙事,而不只是添加一种 3D 外观。它按制作顺序推进:项目简报、故事大纲、角色与环境卡、标准化六栏镜头表、文字分镜、模型选择、逐镜头生成、全片合成、BGM 匹配和最终审查。

确认节点本身就是它的价值。画面尺寸和总时长会在早期确定,高成本的后续工作开始前也会确认关键创意选择。该 Skill 将 H3 列为默认视频模型,将 Seedance 2.0 列为后备方案,因此它是一套更广义的导演工作流,而不只是 H3 提示词模板。

当角色一致性、场景连续性、表演、摄影机方向和节奏必须跨镜头保持时,应选择它。对于一次性短片或仅咨询提示词的任务,这套流程会显得过重。

4. papercraft-stop-motion-explainer:分层知识设计

这是两套纸艺科普工作流中更深入的一套。它把科学、教育或通识主题转化为可触摸的微缩世界,涵盖纸艺角色、分层立体布景、道具、实体阴影、摄影机规则、转场、旁白和审查标准。

完整流程可覆盖创意方向、4 至 7 个视觉层次、素材规划、预览图、系列图片提示词、短视频提示词、分镜、剪辑节奏、旁白清理、负向提示词和质量审查。如果用户只需要一项交付物,例如静帧提示词或 5 秒图生视频提示词,它也定义了轻量直达路径。进入视频生成后,默认使用 H3;除非用户选择其他可用模型,或 H3 当前不可用。

当讲解内容适合通过机械结构、剖面、立体书舞台或纸艺讲述者呈现时,应选择它。如果源内容只是一句短观点或旁白,目标是编辑式 B-roll,下一套 Skill 往往更合适。

5. brand-promo-video-generator:先核验来源,再做宣传

这套工作流适用于拥有可核验源素材的品牌、产品、网站、App、商店或个人项目。它可以从 Logo、产品图、界面截图、官方网站或一个明确想法开始,但在选择叙事主线前,会先建立品牌事实表和素材来源清单。

当身份与卖点的准确性和视觉质感同样重要时,它就是合适的选择。流程会规划精确节拍和运动,在生成前要求明确确认,制作所需的图像、视频、人声或音乐素材,并在交付前审查。它的来源政策拒绝把 Logo 聚合站、缩略图、粉丝重制品或 AI 生成替代品当作品牌身份素材。

如果实体产品及其不同款式是影片中心,应选择极简产品广告 Skill。如果需要统筹更广泛的品牌故事、经过核验的界面、能力宣称、使用场景和行动号召,则选择这一套。

6. music-video-subtitle-generator:让歌词成为场面调度

可安装的 Skill 名称是 music-video-subtitle-generator,但仓库文件夹名为 mv-subtitle-skill-confirmed。它面向 MV 和情绪短片,让节奏、歌词、表演、参考素材、摄影机语言和画面文字共同构成一个系统。

这套流程会先锁定格式、时长、音乐片段、歌词和参考素材分工,再制定创意约定。它能把超出单次生成时长的作品拆成连续镜头,协调音频连续性、设计随节拍变化的空间排版、审查提示词并提供拼接指导。H3 是它支持的生成路径之一,但不是唯一选项。

当文字本身就是画面构图的一部分时,应选择它。普通字幕、字幕校对和通用视频编辑应交给剪辑工作流,因为这套 Skill 把歌词和排版都视为艺术指导。

7. co-op-game-intro-generator:边界清晰的游戏菜单配方

这套 Skill 的内容约定最具体:两名玩家、一个游戏标题、一种视觉风格,以及可选的角色参考图。它先基于固定菜单框架制作确认图,其中包含协调统一的配色、UI、角色、字体、按钮和图标。

只有确认图片通过后,它才会根据已接受的画面、最终 UI 文案、玩家与游戏信息、事件时间点、运动指示和负向约束,重新构建最终 H3 视频提示词。包内两份提示词模板都是必需文件;如果缺失任意一份,Skill 要求停止,而不是临时编造结构。

它适合制作角色驱动的游戏菜单、开场动画、概念短片或社交内容,但不会开发可玩的游戏、复杂应用界面或没有玩家名片结构的通用片头。

8. paper-collage-explainer-generator:编辑式隐喻与 B-roll

这套 Skill 把一句旁白、一个观点、一个故事节点或抽象主题转化为高级网点纸拼贴。它的视觉系统结合大块色域、黑白照片剪纸、彩色卡纸点缀、暖色描边、纸张阴影和定格组装动作。

流程先确认制作方案和分镜,再建立静帧规范,并在生成短片前确认静帧。默认音频规则非常明确:保留有触感的拼贴音效,但除非用户提出要求,否则不添加 BGM、旁白或字幕。

需要简洁视觉隐喻、编辑式讲解或社交 B-roll 时,就选择它。主题需要角色、分层机械结构、立体布景或更完整的教育制作包时,则选择 papercraft。

9. handdrawn-live-video-generator:一镜到底的可控混合场景

这套工作流刻意保持狭窄。它会用用户主要输入语言编写一条 15 秒、16:9 的提示词:真实空间中出现一个粗粝发光的手绘存在。前 3 秒内,手绘元素必须与真实的手或物体发生清晰接触;随后它作为同一个存在连续变形并逃跑,手持摄影机则略慢半拍地追随。

材质语言是蜡笔、粉笔、彩色铅笔、粉彩或粗糙画笔,而不是干净矢量动画、平滑霓虹、3D CG、毛绒质感或恐怖风格。该 Skill 会等用户明确确认后才建议使用 H3 生成,并检查接触真实感、变形连续性、摄影机延迟、笔触质感和整体基调。

它适合一个超现实但物理关系清楚的实拍融合镜头。多场景故事、精致动画流水线或恐怖变形都会破坏这套 Skill 的核心结构。

MiniMax H3 Skill 决策树

先确定交付物,再根据素材和确认要求缩小范围:

  1. 只需要可直接交给 H3 的提示词。 使用 h3-prompt-writing
  2. 需要完整制作工作流。 再按内容类型选择:
    • 实体产品是中心 → minimalist-product-ad-generator
    • 更广泛的品牌、App、网站或商店故事 → brand-promo-video-generator
    • 多镜头风格化 3D 叙事 → 3d-animation-short-generator
    • 由歌词和节奏驱动的视频 → music-video-subtitle-generator
    • 双人游戏菜单或片头 → co-op-game-intro-generator
    • 单场景实拍与手绘融合 → handdrawn-live-video-generator
    • 科普或抽象概念 → 在两套纸艺工作流中选择:
      • 分层教育布景和机械结构 → papercraft-stop-motion-explainer
      • 编辑式隐喻、旁白节点或拼贴 B-roll → paper-collage-explainer-generator

如果仍有两条路线看起来都合适,就选择你已经具备其必需输入的那套。产品照片更适合极简广告流程;获授权的 Logo、官方网站和界面截图更适合品牌宣传;已锁定歌词和音乐片段则更适合 MV 流程。Skill 的首次信息收集要求,往往比风格名称更能说明它真正要解决的问题。

提示

不要在同一任务中叠加两套完整制作 Skills。选定一套来统一负责需求、确认节点和素材方案。 只有在提示词交接阶段确实需要严格的模式结构时,才额外加入 h3-prompt-writing

如何安装这些 Skills

仓库使用 skills CLI。安装前可先运行以下命令查看所有可用包:

npx skills add https://github.com/MiniMax-AI/MiniMax-H3 --list

使用仓库记录的命令一次安装全部 9 个 Skills:

npx skills add https://github.com/MiniMax-AI/MiniMax-H3 --skill '*'

如果想让 Agent 配置更精简,只安装当前需要的工作流:

npx skills add https://github.com/MiniMax-AI/MiniMax-H3 --skill h3-prompt-writing

h3-prompt-writing 替换为表格中的可安装 Skill 名称即可。先安装一个 Skill,能更清楚地理解其确认节点和交付约定,也能避免多套指令彼此竞争。

在 OmniArt 中使用选定的工作流

合适的 Skill 应在生成前减少歧义:最终留下锁定的需求、职责明确的参考素材、确认过的视觉方向或结构化 H3 提示词。它并不能保证每次生成都完整保留人脸、产品、画面文字、物理互动或时间点。请保留确认帧和源素材,审查整段短片,并在关键限制发生偏移时重新生成或剪辑。

当选定的工作流进入生成交接环节时,打开 OmniArt 中的 MiniMax H3。把图像、视频、音频和提示词决策放在同一个创作工作台中;制作需要其他模态时,再继续使用 OmniArt 的图像、视频、音频或音乐工具。若想深入了解参考素材标签与时间线结构,可阅读 MiniMax H3 提示词指南

实用原则很简单:按工作流边界选择,而不是按视觉相似度选择。输入和检查节点都匹配的专用 Skill,往往比看起来更通用、实际却负责了错误制作问题的模板更有用。

准备好创作了吗?

开始用 AI 生成精彩内容

免费开始