把八个 AI 技能攒成一套自己的体系:tta 系列全景(V0)

1027 字
5 分钟
把八个 AI 技能攒成一套自己的体系:tta 系列全景(V0)

拿到一套成体系的 AI 技能仓库,一共 8 个 skill,覆盖了 PPT、文风、插画、封面、HTML 文档、网页动画、前端、UI 生成。它原本是另一个开发者(oil)开源的东西,我 fork 下来改名成了自己的 tta 系列。

逐个读完 SKILL.md 之后,最深的感受是:这不是一堆零散提示词的堆叠,而是一套有明确设计哲学的生产系统。这篇先把它们本来的规范和流程长什么样记下来——V0 版,算是这套系列自己博客集的开篇。之后每一次较大的迭代或更新,都会对应发 V1、V2,逐步把它磨成完全自己的形状。

tta 系列插画风代表:feedback-loop 示例
tta 系列插画风代表:feedback-loop 示例

八个技能,各管一摊

skill干什么上游核心规范一句话
tta-ppt16:9 HTML 演示稿状态机驱动,AI 只执行当前一步,逐页创作
tta-tone中文/英文文风规范事实边界是硬规则,避 AI 表达有清单
tta-visual漫画墨线插画固定画风:墨线+网点+火柴人+黄边牧
tta-cover视频封面生成三画幅无人物,标题由 Agent 提炼
tta-html单页 HTML 分享文档拟真 UI 代替文字描述
tta-motion网页交互动画先生图锁帧,再 AI 视频补中间帧
tta-frontend前端实现与评审单一权威来源,禁止伪操作
tta-draw-uiUI 生成与还原纯净边框图锁导航,结构代码化

三个最有分量的设计思路

① 重复劳动全部脚本化,还强制留证据。 cover 用 ffmpeg 本地预筛候选帧(清晰度+亮度+内容度硬过滤),模型只做”语义选帧”这一件事;motion 用 motion_budget.py 自动裁决交付格式;每次生成都留 prompt/analysis/manifest 三份 sidecar。把”哪些交给模型、哪些交给程序”划得干干净净:模型只做语义判断,程序只做确定性处理

② 质量门禁不是口号,是显式步骤。 每个 skill 都有”不可违反清单 + 交付前自查”。ppt 有一长串阻塞项(HTML 结构损坏、文字溢出、远程资源、跨页 CSS 污染);visual 要求 label 逐字符比对、禁止用独立文字层掩盖错误;html 有最小字号 14px、彩色不超过两色相这些硬指标。

③ 强触发约束,防止误用。 大部分 skill 要求”用户明确点名才启用”。html 甚至写明:你说”帮我做份 HTML”它都不会自动触发,必须点名 oil-html。这跟现在很多 skill 抢着自动触发正好相反。

几条值得抄的具体做法

  • 文风当基建:tone 是所有内容 skill 共用的文案层,ppt/html/cover 都引用它。人称规则清晰(「我」讲自己、「我们」面向读者、「你」仅指导操作),还配了 tone_lint.py 自动查 AI 腔。
  • 先生图后视频:motion 用”先生成首尾关键帧,再用 AI 视频补中间”,色键背景是硬门槛,插帧 48FPS,清晰度优先、体积其次。
  • 先删后建:frontend 和 draw-ui 都强调”先删除无效内容再实现”,改前端前先明确真正出错的位置。
  • 剪裁而非降级:ppt 拆页压缩只删冗余,不删事实、原因、影响、步骤。
  • 透明素材分级:draw-ui 把小 logo 白底转 alpha,大插画走绿幕,不混装一张素材板。

tta-cover 封面成品示例
tta-cover 封面成品示例

这套体系的共同基因

读完 8 个 SKILL.md,能总结出五条贯穿始终的原则:

  1. 忠于内容,不编造事实、不虚构来源
  2. 产物只写最终态,不写 changelog
  3. 一个含义只保留一个权威来源
  4. 强触发约束防误用
  5. 重复性工作脚本化 + sidecar 证据留痕

这套体系最大的价值不是某个 skill 多好用,而是它们共享同一套设计哲学——把「确定性」和「创造性」分层:程序守住边界,模型在边界内发挥。这正是我后续做个性化改造时要保持的骨架。

评论区

像发消息一样写就好:点工具栏插入表情 / 图片,表情会直接显示。插图 ≤5MB。