告别手动配图:baoyu-skills 开源 AI 技能集如何一键跑通内容创作全流程
【免费下载链接】baoyu-skills项目地址: https://gitcode.com/gh_mirrors/ba/baoyu-skills
晚上十一点,你刚写完一篇技术文章,正文只花了一小时。接下来才是真正的消耗战:画系统架构图、找三张配图、做公众号封面、再裁出小红书尺寸……等全部搞定,已经凌晨一点半。写文十分钟、配图两小时的体验,技术写作者多半都懂。baoyu-skills 正是冲着这个痛点来的:它是一套面向 AI Agent(Claude Code、Codex 等)的开源 AI 内容创作技能集,把"从草稿到发布"的整条流水线拆成 20+ 个即插即用的技能模块,每一步都是一句话的事。
像点菜一样挑技能:安装只装你需要的
仓库里 20+ 个技能大致分成三桌:
| 分类 | 代表技能 | 一句话说明 |
|---|---|---|
| 内容创作 | baoyu-article-illustrator、baoyu-infographic、baoyu-comic、baoyu-cover-image、baoyu-xhs-images、baoyu-slide-deck | 把文字变成成套视觉物料 |
| 生成后端 | baoyu-image-gen、baoyu-danger-gemini-web | 提供真正"出图"的引擎 |
| 工具链 | baoyu-format-markdown、baoyu-translate、baoyu-markdown-to-html、baoyu-compress-image | 打磨内容本身 |
第一课是"别贪多"。官方文档反复强调:只装真正用得到的技能,全量安装反而会给 Agent 每次运行增加不必要的上下文负担。项目级安装只需要把技能目录复制到.agents/skills/:
git clone https://gitcode.com/gh_mirrors/ba/baoyu-skills # 按需复制,别全装 cp -r baoyu-skills/skills/baoyu-cover-image .agents/skills/ cp -r baoyu-skills/skills/baoyu-article-illustrator .agents/skills/ cp -r baoyu-skills/skills/baoyu-post-to-wechat .agents/skills/装好后,在对话里喊/baoyu-article-illustrator这类命令就能触发。每个技能都是自包含的独立目录,从仓库里拆出来单独用也不会坏,想深入研究的可以看看技能编写规范。
一条命令,把 Markdown 变成成套配图 🎨
装好之后最常用的场景,是你手里只有一篇 Markdown,却需要一整套视觉物料。
baoyu-article-illustrator会先读文章、分析结构、找出需要配图的位置,再按类型 × 风格 × 配色三个维度自动出图。类型决定"画什么"(流程图、对比图、时间线……),风格决定"怎么画"(notion 手绘、蓝图的工程感、水彩的柔和……)。系统架构类的文章,交给它几分钟就能得到一张蓝图风格的架构图:
蓝图风格架构图:模块分层、箭头标注数据流向,尺寸标尺一应俱全
需要高密度信息图时,换baoyu-infographic。它提供 21 种布局 × 22 种风格的组合:布局回答"信息怎么排"(鱼骨图适合根因分析、漏斗图适合转化流程、维恩图适合概念重叠),风格回答"看起来什么感觉"(手工拼贴、赛博霓虹、乐高砖块……)。默认按内容推荐组合,也能手动指定:
/baoyu-infographic docs/engine.md --layout fishbone --style technical-schematic发动机工作原理被拆解为四冲程示意、剖面图和尺寸标注的技术信息图
封面同样可以交给 AI。baoyu-cover-image用 类型×配色×渲染×文字×情绪 五个维度组合出图,11 种配色与 7 种渲染风格相乘,足够覆盖大部分公众号和博客的调性:
为"系统架构"主题自动生成的封面:蓝图网格配装饰性排版,专业感直接拉满
当文字需要"讲"出来:漫画、卡片与图表
配图只是第一步。当你想把知识真正"讲"给读者时,这套技能集还有更会讲故事的手段。
baoyu-comic能把抽象概念转成叙事漫画。艺术风格(ligne-claire、manga、水墨、写实)× 情感基调(温暖、戏剧化、复古)× 分镜布局(标准、电影感、webtoon 竖版)自由搭配,分镜脚本参考在 layouts 目录。
漫画分镜:主角从困惑到"原来如此"的顿悟瞬间,用可视化的方式讲清一个概念
面向小红书场景,baoyu-xhs-images会把一篇长文拆成 1-10 张卡片,风格 × 布局自由组合,sparse到dense的密度梯度对应不同信息量:
一份效率工具清单被自动拆成三栏知识卡片,小红书排版直接可用
顺带一提,baoyu-diagram不走图像模型,而是让 Agent 直接手写 SVG——流程图、时序图、架构图输出为自带暗色适配的矢量文件,嵌入文档永不模糊。
背后的"万能插座":多供应商图像引擎 🔌
上面这些花样的背后,站着一个统一的引擎baoyu-image-gen。它把 10+ 家图像 API 抽象成同一套接口——OpenAI、Google、OpenRouter、阿里通义万相(DashScope)、MiniMax、即梦、豆包 Seedream、Replicate,全部可用:
type Provider = "google" | "openai" | "azure" | "openrouter" | "dashscope" | "zai" | "minimax" | "jimeng" | "seedream" | "replicate" | "agnes" | "codex-cli";自动选供应商的逻辑很省心:只配了一把 API key 就直接用那家;配了多把就按默认优先级(Google → OpenAI → Azure → OpenRouter → DashScope……)路由;传了参考图--ref时,会优先挑支持参考图的供应商。批量出图也内置并发控制,每家供应商有独立的并发上限和请求间隔,避免被限流。
一个很实在的细节:还没申请任何 key 也能跑。codex-cli后端会直接调用本机 Codex CLI 的 image_gen 工具,走你已有的 Codex 订阅配额,封装代码在 packages/baoyu-codex-imagegen/。所有 key 统一放进.env,加载优先级从高到低:命令行环境变量 > 系统环境变量 > 项目级.baoyu-skills/.env> 用户级~/.baoyu-skills/.env。
从"生成"到"发布":输出物直接送进公众号 📤
生成只是前半场,发布是后半场。baoyu-post-to-wechat支持三种发布方式:API(最快,配置 AppID/Secret)、浏览器(Chrome 扫码登录,零配置)、远程 API(本机 IP 不在微信白名单时,通过 SSH 隧道借一台白名单内的服务器转发,密钥不出本机)。多账号场景用 EXTEND.md 维护账号列表,发布前按别名一键选择。
配套技能把整条链路焊死:baoyu-format-markdown整理草稿结构 →baoyu-markdown-to-html转成公众号兼容的排版 HTML →baoyu-post-to-wechat发布。X 和微博也各有对应技能,写一遍内容,多渠道分发。这套"Markdown 自动生成配图并发布"的组合,就是项目 README 里推荐的公众号最小工作流。
哪些场景该用它,哪些不该
把它放进日常工具箱之前,先看清边界。
适合:技术文档和教程配图(架构图、原理图、流程图)、公众号长文创作(封面 + 内文插图 + 发布)、小红书/微博短内容(卡片、漫画)、内部演示材料、多语言翻译。不太适合:高精度工程图纸(还得交给 CAD)、品牌视觉识别系统(需要设计师把关)、复杂动画与交互内容。另外要诚实提醒:baoyu-danger-gemini-web和baoyu-danger-x-to-markdown走的是逆向 API,文档里明确写着"使用风险自负",稳定性不做保证,生产环境慎用。
写在最后
baoyu-skills 的设计哲学很朴素:把重复的视觉劳动标准化成技能,让 AI Agent 照着指令自动完成,人只需要把关注点和做审核。推荐渐进式采用——先挑一两个最痛点的技能(比如 baoyu-cover-image 配 baoyu-article-illustrator),完整跑通一次"写 → 配 → 发"的流程,再按需扩展。而当你需要一张"独特的手工表达"时,还是亲自上手吧——工具的边界,恰恰是创造力的起点。
【免费下载链接】baoyu-skills项目地址: https://gitcode.com/gh_mirrors/ba/baoyu-skills
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考