网易首页 > 网易号 > 正文 申请入驻

首个中文Stable Diffusion模型,封神榜团队开启中文AI艺术时代

0
分享至

机器之心发布

机器之心编辑部

生成内容一直被视为 AI 领域中最具有挑战性的能力,最近大火的 AI 绘画背后,是 Stable Diffusion 模型的开源,催生了众多 AI 绘画的应用,得益于 Stability AI 的开源精神,这一创变推动了整个以英文为主的下游文生图生态的蓬勃发展。

然而在国内,目前大部分团队主要是基于翻译 API + 英文 stable diffusion 模型进行开发,但由于中英文之间所得存在文化差异导致遇到中文独特的叙事和表达时,这种模型就很难给出正确匹配的图片内容。因此,IDEA 研究院认知计算与自然语言研究中心(IDEA CCNL)开源了第一个中文版本的 stable diffusion 模型“太乙 Stable Diffusion”,让中文的世界真正拥有具备中国文化内核的 AIGC 模型。

  • 太乙 Stable Diffusion 纯中文版本:https://huggingface.co/IDEA-CCNL/Taiyi-Stable-Diffusion-1B-Chinese-v0.1
  • 太乙 Stable Diffusion 中英双语版本:https://huggingface.co/IDEA-CCNL/Taiyi-Stable-Diffusion-1B-Chinese-EN-v0.1

中文运笔,意境浮现

君不见黄河之水天上来 ,唯美,油画

滔滔江水,连绵不绝 ,唯美,插画

飞流直下三千尺 ,唯美,插画

长城,清晨,朦胧,唯美,插画

梦回江南,中国古代小镇,唯美,插画

云南苗家古寨,原始森林,鸟语花香,唯美,插画

中国的未来城市,科幻插画

中文 vs 英文的图片生成

中文指导的特定风格生成

小桥流水人家,水彩

(Taiyi-Stable-Diffusion-1B-Chinese-EN-v0.1)

小桥流水人家,Van Gogh style

(Taiyi-Stable-Diffusion-1B-Chinese-EN-v0.1)

太乙系列文本生成图像模型技术揭秘

第一个开源中文 CLIP 模型

2022 年 7 月,IDEA CCNL开源了第一个中文 CLIP 模型,目前已经有 4 个版本。

  • Taiyi-CLIP-Roberta-102M-Chinese:https://huggingface.co/IDEA-CCNL/Taiyi-CLIP-Roberta-102M-Chinese
  • Taiyi-CLIP-Roberta-large-326M-Chinese:https://huggingface.co/IDEA-CCNL/Taiyi-CLIP-Roberta-large-326M-Chinese
  • Taiyi-CLIP-RoBERTa-102M-ViT-L-Chinese:https://huggingface.co/IDEA-CCNL/Taiyi-CLIP-RoBERTa-102M-ViT-L-Chinese
  • Taiyi-CLIP-RoBERTa-326M-ViT-H-Chinese:https://huggingface.co/IDEA-CCNL/Taiyi-CLIP-RoBERTa-326M-ViT-H-Chinese

以 Taiyi-CLIP-Roberta-large-326M-Chinese 为例,IDEA CCNL用中文语言模型替换了开源的英文 CLIP 中语言编码器,在训练过程中冻结了视觉编码器并且只微调这个中文语言模型,在 1 亿级别的中文数据上训练了 24 个 epoch,一共过了约 30 亿中文图文数据,得到了这个包含图片信息的中文表征语言模型,为后续训练中文 Diffusion 相关的模型奠定了重要的基础。

第一个开源中文 Disco Diffusion 模型

2022 年 10 月,IDEA CCNL开源了第一个中文 Disco Diffusion 模型 Taiyi-Diffusion-532M-Nature-Chinese,该模型由 Katherine Crowson's 的无条件扩散模型在自然风景图上微调而来。结合 Taiyi-CLIP-Roberta-large-326M-Chinese 可以实现中文生成各种风格的风景图片。

东临碣石,以观沧海,水何澹澹,山岛竦峙:

第一个开源中文 Stable Diffusion 的模型

2022 年 11 月,IDEA CCNL开源了第一个中文 Stable Diffusion 的模型和中英双语 Stable Diffusion 模型。

  • 太乙 Stable Diffusion 纯中文版本(Taiyi-Stable-Diffusion-1B-Chinese-v0.1)

该模型利用已经开源的太乙 CLIP 模型 (Taiyi-CLIP-RoBERTa-102M-ViT-L-Chinese) 替换了英文 stable-diffusion-v1-4 中的语言编码器,因为太乙 CLIP 模型已经具备了很强的中文图文概念,所以直接冻结英文 stable diffusion 的生成模型部分,在亿级别的高质量数据上微调语言编码器,调整学习率等超参数,将太乙 CLIP 模型理解的中文图文概念与 stable diffusion 生成能力对齐。

  • 太乙 Stable Diffusion 中英双语版本(Taiyi-Stable-Diffusion-1B-Chinese-EN-v0.1)

不同于太乙 Stable Diffusion 纯中文版本,这个模型希望在支持中文的情况下,同时能保留 stable-diffusion-v1-4 的英文生成能力。由于 stable-diffusion-v1-4 原有语言模型不具备太乙 CLIP 模型强大的中文图文概念,IDEA CCNL希望在它的基础上增加了中文数据训练,这里采取了两阶段的训练。第一阶段也是冻住 stable-diffusion-v1-4 的生成模型部分,在亿级别的高质量数据上微调语言编码器,调整学习率等超参数,训练语言模型中文部分的表征。第二阶段放开 stable-diffusion-v1-4 的生成模型部分,增强中文引导图片生成的能力,目前训练中的一个 checkpoint 已取得不错的效果并进行了开源。

使用方法

如果需要进行古诗场景、中文概念生成,建议尝试中文版本 Taiyi-Stable-Diffusion-1B-Chinese-v0.1。如果需要一些通用场景和概念的生成,尤其是有中文混合英文需要,建议尝试中英双语版本 Taiyi-Stable-Diffusion-1B-Chinese-EN-v0.1。

中文版本:

中英双语版本:

太乙 - 中文 Stable Diffusion 的未来

目前在庞大的中国市场中,有将近 10 亿的文化产业正在被 AIGC 冲击并快速创新发展,也有更多的新机遇在裂变中产生。由于此前的 AIGC 模型还无法和特殊的中国文化背景相结合,致力于成为中文认知智能的基础设施的 IDEA 研究院认知计算与自然语言中心,希望通过推出太乙模型,助力加快在 AIGC 全球市场化中中国的文化产业数字化转型的创新发展,促进各个相关行业的升级。而太乙所在的封神榜预训练模型开源体系,已经开源 80 个模型,覆盖 AIGC、自然语言理解、受控文本生成等多个领域,成为中文最大的预训练模型开源体系。基于封神榜模型的 GTS 模型生产平台,自动生产的 1 亿参数模型,击败众多百亿千亿参数模型,进入 FewCLUE 榜单前三名,机器自动化生成模型的能力达到了算法专家水平,AI 生产 AI 的时代正在到来。

IDEA CCNL认为,在 AIGC 中,人的作用是更为重要的,生成式 AI 应悄无声息地融入大众生活中并更好地帮助拓展人类的想象力边界。所以,与 AI 互动生产的内容,是帮助AIGC走向下一个生产力阶段的关键。因此,IDEA CCNL除了基础模型和基础算法的研究之外,还在研究更精准的文本生成和基中文于文本的交互式图片编辑。以太乙为核心的 AIGC 模型会持续更新和升级,敬请期待。

欢迎对太乙感兴趣的小伙伴们联系IDEA CCNL,一起共建中文 AIGC 的新世界。

封神榜相关链接:

  • 封神榜总论文(中英双语):https://arxiv.org/abs/2209.02970
  • 封神榜主页:https://github.com/IDEA-CCNL/Fengshenbang-LM(封神榜大模型)是 IDEA 研究院认知计算与自然语言研究中心主导的大模型开源体系,成为中文认知智能的基础设施。
  • huggingface 地址:https://huggingface.co/IDEA-CCNL
  • 封神榜 doc: https://fengshenbang-doc.readthedocs.io/zh/latest/

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
“五一”出游拍照别再比“剪刀手”了 小心指纹被隔空盗取

“五一”出游拍照别再比“剪刀手”了 小心指纹被隔空盗取

环球网资讯
2026-05-02 07:27:27
溺水获救女子开口第一句泪目!救人夫妻身份不简单,获全市表彰

溺水获救女子开口第一句泪目!救人夫妻身份不简单,获全市表彰

奇思妙想草叶君
2026-05-01 16:10:44
王健林时代落幕,输给了这个靠赵薇起家、截胡许家印的湖北富豪!

王健林时代落幕,输给了这个靠赵薇起家、截胡许家印的湖北富豪!

历史伟人录
2026-04-29 17:41:50
英超提前保级?利兹联3-1后领先热刺9分,伦敦2强和森林降级3选1

英超提前保级?利兹联3-1后领先热刺9分,伦敦2强和森林降级3选1

体育知多少
2026-05-02 06:59:51
孙杨报案,评论区笑死我了……

孙杨报案,评论区笑死我了……

麦杰逊
2026-05-01 20:17:51
高洁主任:半夜易醒,睡眠浅?每天拍打这处50次,让你一觉到天亮

高洁主任:半夜易醒,睡眠浅?每天拍打这处50次,让你一觉到天亮

大明爱养生
2026-04-28 14:17:50
电价改革要来了:国家为什么在这个时候“动”电价?

电价改革要来了:国家为什么在这个时候“动”电价?

趣文说娱
2026-04-28 22:06:04
辞职4个月,35岁的张水华终于喊出了这句话!361度放走一棵摇钱树

辞职4个月,35岁的张水华终于喊出了这句话!361度放走一棵摇钱树

风过乡
2026-05-02 07:42:45
宴会上,毛主席问溥仪:传国玉玺去哪了?溥仪的回答引起一片哗然

宴会上,毛主席问溥仪:传国玉玺去哪了?溥仪的回答引起一片哗然

浩渺青史
2026-05-01 01:14:21
全球卖疯的无人机,北京为何禁售?

全球卖疯的无人机,北京为何禁售?

碳基打工人
2026-05-01 02:41:19
“三哥,你尾款我不要了!”中国外贸人反杀印度老赖,招招绝了!

“三哥,你尾款我不要了!”中国外贸人反杀印度老赖,招招绝了!

坠入二次元的海洋
2026-05-01 15:25:23
广东男子中风瘫痪,妻女照顾两月不耐烦,故意外出8天将其饿死

广东男子中风瘫痪,妻女照顾两月不耐烦,故意外出8天将其饿死

小李子体育
2026-05-01 00:01:35
太讽刺!2026劳模名单争议大,被疑有“许家印”,评论区不留情面

太讽刺!2026劳模名单争议大,被疑有“许家印”,评论区不留情面

谭谈社会
2026-05-01 14:42:03
新华社消息|商务部:坚决反对美国联邦通信委员会审议通过检测认证和电信领域相关限制措施

新华社消息|商务部:坚决反对美国联邦通信委员会审议通过检测认证和电信领域相关限制措施

新华社
2026-05-01 14:48:10
打什么电话比12345更管用?这些电话比它管用100倍,建议收藏好

打什么电话比12345更管用?这些电话比它管用100倍,建议收藏好

细说职场
2026-04-28 10:39:02
掘金出局!约基奇无奈爆金句:这要在塞尔维亚,全队早被炒了

掘金出局!约基奇无奈爆金句:这要在塞尔维亚,全队早被炒了

仰卧撑FTUer
2026-05-01 14:26:15
站台抽烟铁路员工向沈女士道歉,女子全网社死不敢发声,官方回应

站台抽烟铁路员工向沈女士道歉,女子全网社死不敢发声,官方回应

小鋭有话说
2026-04-30 20:53:37
被压制!骑士落后10分陷被动:全队三分18中5,哈登8分4助苦撑

被压制!骑士落后10分陷被动:全队三分18中5,哈登8分4助苦撑

体坛小李
2026-05-02 08:54:01
伦敦世乒赛爆出大冷,孙颖莎闺蜜输球!世界冠军惨败,赛后哽咽

伦敦世乒赛爆出大冷,孙颖莎闺蜜输球!世界冠军惨败,赛后哽咽

老王大话体育
2026-05-02 02:08:17
火湖G6首发出炉:湖人变阵里夫斯顶替肯纳德首发 东契奇KD缺席

火湖G6首发出炉:湖人变阵里夫斯顶替肯纳德首发 东契奇KD缺席

醉卧浮生
2026-05-02 09:10:44
2026-05-02 10:16:49
机器之心Pro incentive-icons
机器之心Pro
专业的人工智能媒体
12902文章数 142639关注度
往期回顾 全部

科技要闻

AI热潮耗尽库存,Mac Mini起售调高200美元

头条要闻

男子买虚拟手机号领券骗取超市70多万 获刑十年十个月

头条要闻

男子买虚拟手机号领券骗取超市70多万 获刑十年十个月

体育要闻

无奈!约基奇:这要在塞尔维亚 全队早被炒了

娱乐要闻

马筱梅产后身材恢复超好 现身户外直播

财经要闻

雷军很努力 小米还是跌破了30港元大关

汽车要闻

限时9.67万起 吉利星越L/星瑞i-HEV智擎混动上市

态度原创

亲子
健康
房产
手机
公开课

亲子要闻

分享我独特的带娃方式

干细胞治烧烫伤面临这些“瓶颈”

房产要闻

所有户型全卖爆!海口TOP级豪宅,景观样板间五一全线开放!

手机要闻

Anbernic RG Rotate更多信息:3.5英寸720×720旋屏,87.99美元起

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版