![]()
嗨大家好,我是阿真!
上周分享了一个 Skill,调用 Skill 然后给到文章就可以直出全部配图的,灵感来自于大善人歸藏藏师傅的 guizang-ppt-skill,这个是基于他的 Skill 去进行修改的。
我做好了一套小红书 3:4 比例的,现在差不多可以拿出手了,PPT 的版本还有点小问题,我再优化优化,后期再和大家分享。
这个 Skill 最终的产出是下方这样的,我们可以有自己的 IP 配图作为插图,色调和字体也都可以自己去调整。产出的内容要详细要简单或者要配图也可以自己要求。
这是阿真常用版,是给到我的上一篇文章后,直出的网页预览效果和导出图片效果
![]()
图片效果
![]()
![]()
![]()
讲历史的 IP 我也尝试了一版。不过这个表情包我没有仔细盯,做得稍微粗糙了一点。
![]()
![]()
![]()
不想要配图的时候,要求 AI 具体哪些页面使用纯文字版本也可以,可以看有图和无图的对比。
![]()
还尝试了一个潮玩版
![]()
![]()
![]()
![]()
![]()
![]()
![]()
上面是今天要分享的基于 HTML 转的图片,适合小红书小绿书等图文发布使用,整体比较简洁。
如果不喜欢过度简洁和有秩序的,就喜欢 AI 生成直出图的可以看看这篇→,基于 IP 生成图片的,效果是这样的,更多元化一些,效果如下
![]()
![]()
喜欢设置好一个模板以后调用就直接套模板出图请继续往下看这篇~!
设置的前期过程稍微繁琐一点,但是后期使用会非常方便。如果你不喜欢看繁琐的图文教程,那么也可以从这里直接看视频教程
我把整个过程打包成了一个 Skill,你可以用它生成一套属于自己的小红书排版模板。以后只需要给它一篇文档,或者给一个飞书云文档链接,如果要直接读取飞书,需要先连接飞书 CLI,它就可以按照已经定好的 IP 和视觉系统,直接帮你生成整套小红书图片。
安装Skill
第一步还是先安装这个 Skill。安装之后,它会提示已经调用“小红书排版工厂”,并让我们选择使用模式:
![]()
Compact 模式:如果你已经很熟悉这套操作,可以直接给参考图和 IP 相关的介绍文档,再说清楚自己的需求。
Default 模式:如果还不熟悉,就选择这个模式,让它带着我们完成整套引导。
第一次做,我更建议大家走 Default 默认模式。前面的信息给得越完整,后面的素材、排版和 Skill 就越稳定。
![]()
在完整引导中,你可以上传自己的 IP 图片。它会提供一个表格,让你填写 IP 图、Skill 名称、触发词、页脚名字、头像署名和末页账号等信息。
![]()
接着,它会询问你有没有多动作素材,也就是有没有基于自己 IP 做过表情包。
如果有,你就直接说明并提供文件路径。
如果没有,就让它帮你生成,它会先基于 IP 写完整提示词,再继续生成图片。
这里可以选择 20 张精简包,也可以选择 45 张详细包。20 张日常已经够用,45 张的表情和动作更丰富,后续做图文排版时,可选择的图片元素也会更多。这里的表情提示词部分,是 Agent 基于 IP 的图片的风格和气质,以及给到的介绍文档来决定的。
简而言之,它会比较符合这个 IP 的气质。比如我要做的这个历史小吏的,生成表情的方向也会更倾向于他的职业属性。如果方向是很宽泛的那种,我们也可以通过指令要求,比如我希望我的 IP 的讲师职业属性体现更明显,也可以在对话中去要求。
![]()
它会先交付一套图片和对应的完整提示词。图片细节如果有问题,比如小吏 IP 的卷轴拿反了,可以直接基于原提示词做细微调整,再重新生成单张图片,不需要整套重跑。
![]()
图片生成完成以后,一定要自己反复仔细检查图片细节。这里既可以使用系统抠图,也可以自己抠图。Codex 可以直出透明底图片,但是偶尔会出现头图不够干净,中间有马赛克格子的情况。
这时候可以让它自己重做,也可以用抠图工具。我自己抠图可以用 Pixian,大家也可以用你平时习惯的工具去做抠图处理。
![]()
有 IP 的四视图时,直接使用给定的四视图。如果手头只有不完整的照片,就可以让 AI 先生成一张完整全身参考图。关于自己的卡通形象的 IP 怎么做,也可以看这篇文章→
![]()
接下来 IP 定位卡就有了,没什么问题的话就确认,继续推进生成图片。如果你使用的不是 Codex,可以使用即梦,接入即梦 Cli 或者 Lib TV Cli 或外接 API 等去让它生成系列图片,或者直接让它生成表情提示词,然后你到自己常用的平台去完成表情图的生成,完成后把抠图完成的图片给到 Agent。
![]()
有一点很重要,我再提醒一下:一定要等所有人物素材都完成,再推进视觉排版。后面才补素材,很容易出现人物大小差距太大、姿势放不进去、版面留白不合适等问题。
![]()
准备IP素材
确认人物图和表情动作包都没有问题以后,我们在对话里输入“确认素材”。
![]()
这时它才会开始反推排版视觉系统,也就是接下来要生成的小红书常用排版模板。它会先给出 A、B、C 三组视觉建议,让我们选择配色、字体和整体气质。
接下来可以选择逐项确认,也可以直接采用一整套推荐方案。逐项确认时,底色、气质、主色、点缀色、字体、装饰语言和主题命名等内容都会分开选择。你可以按照 A、B、C 自由组合,也可以整套采用其中一组。不知道选什么的时候,优先试试它推荐的那一组。
![]()
如果选择推荐方案,比如选 B,几个维度就会统一按照 B 方案执行。如果选择逐项确认,它会把这些项目一个个列出来。它给出的字体都不喜欢时,可以直接指定字体,或者提供字体文件。配色和装饰也一样,都可以继续给自己的意见。
视觉决策确定以后,它就会进入头像基准校准。这个头像一般放在图片的正文页面右上角,既能强化账号识别,也能补足右上角的留白。
头像完成后,要检查人物有没有被裁切、大小是否合适、和正文区域会不会互相挤压。确认没问题,再进入下一步。前一步完成了它有指引的话就跟着指引继续做,如果没有指引你就自己对它说继续,它会继续推进的。
![]()
保存自己的Skill
这一步需要提供一篇文章或者参考文档,让它跑出第一版 Demo。我当时随便给了一篇历史人物故事,它会先读取素材,再根据文章内容生成整套页面。
![]()
第一版出来后,可能会很不错,也可能有一些地方不满意。这个阶段就继续微调。比如我觉得一开始的卷轴不好看,就让它去掉卷轴造型,同时保留卷轴的配色,再把留白收紧一点。
还可以让它多做几种版面,把后面可能会用到的图文、流程、对比、清单和重点句式都尽量覆盖到。这样保存下来的 Skill 才更适合长期复用。
![]()
当页面效果基本确定,就可以让它保存排版 Skill。这里保存的,就是刚刚我们一起完成的、基于自己 IP 和视觉偏好的专属排版 Skill。
![]()
最后一般会在回答中呈现三部分:
Skill 完整目录。
Skill 的 markdown 文档(放在 1 的目录里了)。
一套已经设置好的多页案例的网页。
交付完成后,直接安装这个 Skill,再给它新的文章或资料,就可以继续制作前面那样的套图。
![]()
![]()
潮玩方向案例
接下来换一个潮玩方向的案例,我们快速过一遍。
假如我要做一套潮玩模板,我也可以直接把自己的 IP 形象、品牌案例和相关文档全部提供给它。它会按照 Default 模式提取资料里的信息,直接完成这一步。
![]()
![]()
接着指定生成数量,比如让它做 20 张表情动作包。它会先基于定位卡规划 8 张通用动作、8 张潮玩场景动作和 4 张情绪补位图,再锁定视觉锚点和关键元素,最后开始建立素材包并生成图片。
![]()
这一步完成后,一定要仔细检查每一张图。动作、手指、道具方向、衣服细节、五官和角色一致性,只要有一项不够好,就直接在对话里要求它重做。
如果交付的是已抠图版,也要确认它有没有真的完成抠图,头发边缘、半透明区域和白边处理得怎么样。效果还不够好,就用抠图工具重新处理,再把成品放回素材库替换原图。
确认素材整理好以后,再让它继续下一步。它会给出一套视觉 tokens,包括主题、配色、字体和装饰语言。草稿文件里会记录更细的规则,暂时看不懂也没关系,第一版效果出来后,我们会更容易判断自己具体想改哪里。
![]()
有时第一版页面会出现显示不完整的情况,不要慌,直接让它检查页面原因并自动修复就可以。
Demo 出来以后,也可以继续调整背景色、右上角头像大小、文字颜色、页面留白和版式数量。
如果图片压到文字、卡片底部余量太小、流程线穿过内容等问题还存在,可以在网页里点选对应位置,通过评论让它修改,也可以直接在对话里说明问题。
修改完成后刷新预览,再看新版页面。质检记录会保存这次具体改了什么。所有细节完成后,再做一次整套预览,确认没有问题再导出图片。
![]()
确认没问题了,就保存这个 Skill。
![]()
下次要调用,就这样操作。
![]()
还有更多进阶玩法,比如说,除了这些以外,大家还可以通过补充图表、修改排版、修改字体去继续调整版面效果。
HTML和生图怎么选![]()
我之前做带 IP 的小红书图片,更多会直接让模型生成整张成品。这个方式的优势很明显,起步快,画面自由度高,人物、场景、光影和装饰可以一起生成,特别适合做氛围强、插画感强、每一页画面差异都很大的内容。
它的限制也比较明显。效果不见得稳定,可能还需要抽卡,版式一致性会波动,人物和文字的位置很难精确控制。想把标题往上挪一点,或者只改一个字,就需要重新生成,而这类图片经过修改后经常会折损细节。页面数量多以后,保持字体、字号、边距和视觉节奏统一也会更费时间。
HTML 方式会把人物素材、字体、颜色、卡片、边距和版式规则先固定下来,再根据文章内容生成不同页面。文字由代码渲染,错字和乱码会少很多;标题、正文和人物位置也更稳定,局部修改通常只需要改对应的文字或样式。
它很适合批量内容和长期复用。同一套模板可以反复读取新文章,自动拆页、渲染、导出,再生成一张联系表做总览检查。做完一次,后面每次调用都会省很多时间。
当然,它的前期准备会更多。人物素材需要提前整理好,字体要能正常加载,视觉 tokens 和页面组件也要先定下来。遇到特别自由的插画场景,HTML 的画面表现力会受到模板结构限制,页面也可能一直带一点排版系统的规整感。
如果这一组内容更看重氛围、故事和单张画面的视觉冲击,我建议优先考虑直接生图。如果内容更看重中文准确、系列统一、可反复修改和长期批量输出,可以考虑用 HTML 模板。
也可以把两种方式结合起来,封面继续用图片模型生成,正文、卡片交给 HTML。这样既保留了封面的表现力和视觉冲击力,也能提高文字和版式的稳定性。
如何多次复用
以后复用这套 Skill 很简单,直接说调用它就可以。只要能调用 Skill 的工具都可以用。也可以给飞书云文档链接,前提是已经连接飞书 CLI。
调用飞书 Cli 的一大好处就是如果你文章中有配图,只要和它说要把图片加进去,那么它也可以直接提取和搭配。
![]()
![]()
它会先根据文章确定这一组图片的内容结构,再并行渲染页面、加载字体,最后生成一张总览联系表进行检查。检查内容通常包括标题区、卡片底部余量、人物与页角、流程线通道等细节。
完全收尾以后,它还会做尺寸和视觉的双重验收。发现问题就继续做局部修正,最后交付整套网页预览、导出图片和联系表总览。图片默认可以导出 2K,发小红书等社交平台已经够用了。
终端党也可以。调用后给文章链接或路径就行
![]()
排版完成以后,发现某一页还有小问题,也可以直接点网页,通过评论修改,也可以看到效果后指出那些页面需要修改。调整结束后让它重新导出就可以。
小结
Skill 链接在这里,安装就是直接复制链接让 Agent 安装就好了。
链接
none
https://github.com/irenerachel/xiaohongshu-layout-factory-skill总的来说,这个 Skill 是一个用来帮你做基于你的 IP 的小红书排版图 Skill 的 Skill,你用这个 Skill 做的 Skill,后续就可以反复复用那个 Skill 来做自己的图片了。哎嘿有点绕了。
再梳理一遍制作流程。
安装小红书排版工厂,第一次选择 Default 模式。
提供 IP、IP 或品牌信息和内容方向。
直接给、生成 20 张或 45 张表情动作包,逐张检查并完成抠图。
输入“确认素材”,再确定配色、字体和装饰语言。
校准右上角头像,用一篇完整文章跑第一个 Demo。
修改版式、留白、颜色、人物位置和页面细节。
保存专属排版 Skill,并完成安装。
以后在新对话里调用第 7 步保存的那个 Skill,提供文档,检查总览的 html 网页效果,没问题再导出 2K 图片。
整套流程里,最需要花时间的其实是前面的素材准备和第一版模板校准。这里做得越认真,后面复用就越轻松哦。
再次感谢藏师傅开源了 guizang-ppt-skill,我的这个 Skill 在其版式和工程化方面从中获益良多,很有收获!
好了,今天的分享就到这里,如果大家也需要做自己的 IP 排版 Skill,可以尝试一下,做好之后需要修改的细节真的不多。对于经常需要发送图文的朋友们来说应该会有帮助。
如果内容大家觉得内容有趣、有用,欢迎在下方 和 鼓励,期待你的猛猛三连,这对阿真真的很重要,非常感谢~
下期见~
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.