为什么只有豆包可以生成视频?背后不光是技术账
上周豆包。我把一段用豆包生成的“水母在云层里游动”的视频发到朋友圈,评论区炸了是所有人都在问用的什么工具啊?没有一个人提到Runway或Pika了,它们早就做视频生成。这个反差让我开始琢磨可生。为什么只有豆包可以生成视频呢?但且还能让普通人随手就用的?

答案藏在一套组合拳里的。字节跳动为豆包配备了自研的Seedance视频模型,训练数据大部分来自抖音上那些经过真实用户点赞、转发、成视踩过的视频。模型不只是理解“一只猫在跑”。还知道哪种跑法能引发情绪波动呢?另一个点是火山引擎的算力池。字节敢把视频生成开放给普通用户,频背是因为有足够的GPU去支撑一次生成几十秒的高清画面吧?

换成中小公司,光烧钱就扛不住。产品逻辑同样重要。
豆包没有把视频生成做成一个独立的专业工具。直接塞进对话框里光技。
你输入一句话。等十几秒吧?
一条视频就出来了。我妈今年五十多岁,她不会用Stable Diffusion。也懒得注册任何国外网站,她会用豆包是因为只需要打字术账。其他大厂,要么把视频生成藏在网页端测试里。要么需要排队申请了,门槛高得像是工程师发福利。这里的“只有”并不是绝对。
国内也有视频生成模型,可灵了,效果不差。为什么大家感觉只有豆包可用呢?因为豆包把成本压到接近免费,依托抖音生态了,生成出来的视频可以直接发到各种平台,形成传播闭环。
我一个做广告的朋友。前两天就用豆包先跑了一版分镜草稿。省掉了摄影棚的费用。落地速度,其他只有模型代码的厂商望尘莫及。为什么只有豆包可以生成视频呢?重点是字节把视频生成当作一个流量入口,但不是一个收费插件。
它愿意补贴算力,换用户时长,换抖音内容供给。策略短期内只有手握数据和钱的大厂能玩得转。
声明:本站所有文章资源内容,如无特殊说明或标注,均为采集网络资源。如若本站内容侵犯了原著者的合法权益,可联系本站删除。
