JOTO
Contact us
← AI 智库
多模态模型

huashu-art-motion发布!可能是最有审美的动画skill。

2026 年 10 月 6 日

huashu-art-motion 是一个开源动画 skill,支持用自然语言指令生成多风格白板动画、艺术史穿越短片及解说类视频。它基于 Claude Code Opus 5.5 实现,可拆解参考视频、生成运动热力图、代码绘图与合成配乐,并内置35种艺术风格卡与8种YouTube常见解说模板。

白板动画与艺术史穿越短片

这种whiteboard(白板)动画,我觉得特别适合B站、YouTube上的长解说和教程:跟着口播一点点画出人物、事件和关系,观众能顺着画面理解你在讲什么。做知识科普、产品讲解,或者给课程配动画,都可以往这个方向试。

开头那支是Q版的我从拉斯科洞穴壁画出发,穿过23种画风,最后回到2026年书桌前的一段动画。每进一幅画,我就换成那幅画的画风,再跟画里的东西玩一下:在古埃及壁画里跳过推着太阳球的圣甲虫,在北斋的巨浪底下缩头躲浪爪,在莫奈的日本桥上打水漂,陪蒙克的呐喊者一起大叫,帽子被叫飞了,又在8-bit的夜空里顶出一枚金币。

艺术史穿越短片封面图
艺术史穿越短片封面图
SpaceX 24年解说动画封面
SpaceX 24年解说动画封面

场景是代码画的,配乐也是代码一个音一个音合成的(没用一个采样),除了我的形象是调用codex的ImageGen生成的(现在codex真的只配给CC打打生图的下手),其余全是Claude Code里的Opus 5.5做的,从拿到参考视频到这一版成片,前后不到一天。

做这些动画的方法,我沉淀成了一个skill,叫huashu-art-motion,装上之后你可以直接跟它说「用梵高《星月夜》的风格给我做一段15秒的动画」,也可以给它参考短片,让它拆解、复刻,或者按你的口播做解说动画。

关于所谓Fable 5.5

如果你前几天刷过X的AI圈,大概率刷到过一批说是Fable 5.5做的动画:有人只给了一句提示词,拿回来一部3分钟、带原创配乐的动画短片,6000多赞;有人让超人在不同画风里一镜到底地连续穿梭,67万浏览;还有一条15秒的艺术史动画,一只猫和一个人在喝茶,背景从洞穴壁画一路换到扁平插画,原作者是Tak(@cherry_mx_reds)。

原片的运动热力图(底图为Tak原片画面,红色为运动区域)
原片的运动热力图(底图为Tak原片画面,红色为运动区域)

截至今天,Anthropic官方并没有发布过Fable 5.5,官方最新的还是9月1号发布的Fable 5.1。这一波作品都来自自称被灰度路由到Fable 5.5的用户(判断方法是一个民间的Tibo测试,不联网问模型认不认识OpenAI Codex团队的Tibo,答得出来就认为是知识更新过的新模型),模型版本本身没有官方确认。

我也把那条视频丢给Claude Code复刻了一遍。不过做完一支同款,我更想留下的是方法:怎么拆画风、让画面里的东西动起来,下次换个题材还能继续用。

复刻时有个挺有意思的细节,它自己做了一张运动热力图,找出原片里哪些区域在动。每个时代虽然只有1秒左右,但浪在卷、文字在闪,画面内部一直有动作。后来这些拆解方法,也一起放进了skill。

复刻之外的自主创作

所以复刻完的当晚,我给了它一个原片里没有的题目:

用我的卡通形象,穿越至少20种不同风格的场景,形象要随着场景变化,并且要跟场景里具体的东西发生互动,比如穿过莫奈的日本桥,往睡莲池子里打水漂。

艺术史穿越动画GIF
艺术史穿越动画GIF

这支片子里,场景和风格用代码画,我的形象则每种画风都用gpt-image重画动作帧,再由代码控制位置、大小和换帧时机,给角色叠上对应画风的笔触。

敦煌风格段落GIF
敦煌风格段落GIF

配乐也跟着画风走:洞穴段是骨笛和手鼓,敦煌是琵琶,浮世绘是三味线和尺八,8-bit是方波。这些声音全部由代码合成,换场景的时候也会换乐器和调式。

8-bit风格段落GIF
8-bit风格段落GIF

适配真实工作场景

不过,除了展示模型的能力,或者自己驾驭模型的能力,我更关心的还是,这个东西能不能用到真实的工作场景中。

所以我们又增加了8种YouTube上常见的解说风格,包括白板、Vox、Kurzgesagt、3Blue1Brown、发布会UI、财经图表、故事和动态文字。讲数据可以用财经图表,讲数学和AI概念可以试3b1b,软件教程里的界面操作可以用发布会UI,具体用哪种,跟着要讲的内容来选。

除了开头的whiteboard,还有这种Vox风格,同样讲SpaceX这24年:

同一个题材换一种表达,画面的感觉就很不一样。你可以把自己的口播交给它,按时长做出对应的动画段,插进正在剪的视频里;也可以像这两支一样,把一段完整的解说做成动画。

对我自己来说,这部分会更常用。做一条B站或者YouTube的长视频,碰到一个光靠说不容易讲明白的地方,就可以单独配一段,让图形跟着讲解一步步展开。

skill 内置能力

除了上面这8种解说风格,里面还整理了几十张艺术风格卡,从洞穴壁画、古埃及、浮世绘、印象派,到梵高、蒙克、达利、霍珀、波普、吉卜力、新海诚、蒸汽波。每张卡里都有配色、笔触、动作的做法,以及目前的短板,下次做的时候可以接着改。

35种艺术风格样片总览(按年代排列)
35种艺术风格样片总览(按年代排列)

拆参考视频的方法、角色怎么生帧和合成、配乐怎么跟画面卡节拍,也都放进去了。做完后会先跑程序检查静止帧、异常跳变等问题,再让一个没参与制作的agent只看成片挑毛病。

我一直要求它把实践里做对的事情记下来,包括做法、证据、为什么、什么时候用。下次换题材、换风格,甚至换模型,这些经验都能带过去。

安装与使用方式

skill开源在GitHub:

https://github.com/alchaincyf/huashu-art-motion

安装(Claude Code、Codex、Cursor等支持skill的agent都可以用):

npx skills add alchaincyf/huashu-art-motion

渲染视频需要本机有uv和ffmpeg,第一次渲染前装一下无头浏览器:uv run --with playwright playwright install chromium(这些你直接让agent帮你装就好)。

装完之后,可以直接这么跟它说:

用梵高《星月夜》的风格,给我做一段15秒的动画,画面里的东西要一直在动
帮我拆解这段动画,告诉我它是怎么做出来的,然后复刻一版:[视频路径]
我这段口播讲的是梯度下降,帮我按3b1b的风格做一段对应时长的动画

如果你想让动画里出现你自己或者某个角色,需要你的agent能调用生图模型(我用的是gpt-image);没有的话,可以让它用代码画几何化的角色,或者直接用你已有的角色图。

做出来的作品也欢迎发给我看看,尤其是skill里还没有的风格,做得好的话,我会把它补进skill的风格卡里。

JOTO 企业落地观察

  • 企业若希望将此类动画 skill 纳入内容生产流程,需评估其对本地计算资源(如 Chromium 渲染、FFmpeg 编码)与多模态 agent 协同能力的实际依赖程度,而非仅关注模型端能力。
  • 该 skill 将“风格卡”结构化为可复用的知识单元,提示企业在构建 RAG 知识工程时,应优先沉淀可验证、可组合、含明确边界(如“当前短板”)的工艺型知识,而非泛化描述。
  • 动画生成中嵌入自动质检(静止帧检测、跳变识别)与第三方 agent 复核机制,为企业 AI 安全治理提供了轻量级可迁移范式:关键输出环节必须设置非生成式校验点。
  • 技能设计强调“做法-证据-适用条件”三位一体记录,这对 FDE 驻场共创中知识萃取提出明确要求——不能只交付结果,必须同步交付可审计的决策链路。

立即咨询 JOTO

JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询

想把这些做法用到你的业务里?

留下你的场景和痛点,我们帮你判断从哪一步开始。

联系我们
Contact Us

Start your enterprise AI rollout

Tell us your industry, team, and current pain points. We'll get back to you within one business day to help you decide what to tackle first, what data to prepare, and which platform fits.

WeChat
Scan to add us for a 1:1 chat
JOTO WeChat consultation QR code

Tell us what you need

Once we receive your details, we'll be in touch within one business day.