写文章最烦的不是写是配图。一篇方法论文章没有 3、4 张图根本没法看。 这一篇记录我怎么把一个免费的生图 APIAgnes接进 Claude Code让「为文章配图」变成一句话的事——以及中途踩的那个让我差点放弃的坑。一、为什么我要自己接生图 API我保持一个内容习惯写完的文章先丢进 Obsidian 的「待发布」文件夹再统一发到 CSDN、知乎、掘金。这些方法论文章没有图基本没人看——讲流程要有流程图讲对比要有对比图。但配图一直是个体力活要么自己画慢要么找图库不贴切要么让 AI 现想 prompt质量飘。我想要的是一句话AI 读懂我的文章自动帮我配好图。市面上的生图服务不少但大多要钱、要key、要翻。我需要一个免费、能脚本调用、能集成进 Claude Code的。最后找到了 Agnes——一个提供免费额度的图像生成 API模型是agnes-image-2.0-flash。二、接入30 行 Python 把 API 包成命令Agnes 的接口是标准的 OpenAI 风格POST一个 JSON 就行。我把它包成一个命令行脚本核心就几行ENDPOINT https://apihub.agnes-ai.com/v1/images/generations body { model: agnes-image-2.0-flash, prompt: prompt, size: size, # 如 1280x720 extra_body: {response_format: b64_json}, } # 图生图(保形象一致)再加:image 字段传参考图调用就变成一行命令python agnes_image.py --prompt 一张白底手绘的苹果 --size 1280x720 --out apple.pngkey 放在~/.claude/skills/.env的AGNES_API_KEY脚本自动读。到这一步「用代码调免费 API 出图」就通了。三、踩坑中文 prompt 直接喂全军覆没接好后我兴冲冲拿真实文章试结果连续翻车。我写的是中文文章很自然就用中文写 prompt「一张 16:9 横版对比信息图纯白背景左边画返工循环右边画一次到位……」。结果生成出来的东西要么是灯笼古风插画、要么是科幻人脸识别屏和我的需求八竿子打不着图上的中文还全是乱码。一开始我以为是玄学连试三张全跑偏才意识到这是系统性问题不是偶发。这就是做工具最容易踩的坑把「模型能力」当成「我的想象」。我以为它能懂中文长描述实际上它不能。四、破局一个对照实验逼出根因我没有继续瞎试而是做了个对照prompt 语言结果中文长描述❌ 风格漂移 中文乱码英文描述✅ 白底手绘、风格准同一模型、同一需求只换语言结果天差地别。根因清楚了agnes-image-2.0-flash本质是个英文文生图模型对中文长描述理解混乱而且图内渲染中文必出错字。找到根因解法就两条釜底抽薪prompt 改英文——画面结构、动作、构图全用英文写中文只用于我自己的分析图内零文字——既然写中文必错那图上干脆不写中文标题说明放到图下方的 markdown 正文里改完再跑同样的文章流程图、对比图一次到位白底手绘、干净利落。五、效果一句话给文章配 3 张图踩平这个坑之后整个流程就顺了。这是它真实生成的效果图上面这张配图本身就是 AI 读完文章后自动生成的——它既是效果展示也是这篇文章主题的活例子。一篇「改原型先确认方案」的文章AI 自动识别出 3 个配图位出了 3 张图对比图——「拿到就画 vs 先确认方案」的返工对比流程图——「选取元素」的五步流程场景图——「圈选 A2」的决策场景白底、手绘、风格统一直接能用。六、写在最后接入 Agnes 这件事技术本身不难——一个 POST 请求而已。真正值钱的是那个踩坑换来的判断免费 API 不是不能用但你得先摸清它的「脾气」。它的短板中文不在文档里写着只有你真实翻车了才知道。而一旦发现「英文 prompt 图内零文字」这个约束它就成了一个稳定可用的免费生产力。这也是我为什么把每个工具都做成 skill 的原因——把「它的脾气」固化下来下次直接用不用重新翻车。下一篇预告光有通用生图还不够我想要图里有个「固定的我」。下一篇讲我怎么把自己的照片做成一个跨图一致的 Q 版 IP 形象 skill。如果这篇对你有用欢迎关注看「AI 工具人 PM 实战」系列更新你在接免费 API 时踩过什么坑评论聊聊觉得有用就收藏备用。