刚从火山FORCE大会回来,心情真的比较激动啊,这次更新的内容非常多,我准时到的现场结果根本挤不进去,但是我还是从开始一直站到结束听完了。
这次核心发布内容就是Doubao-Seed-2.1 Pro和Turbo模型,重点强化了Coding、Agent 长链路任务、多模态理解的几个方向。另外还有面向企业的很多产品和服务。
然后多模态的方向,Seedream 5.0 Pro,Seedance 系列有更新。
图片模型预告了Seedream 5.0 Pro,主打交互式的精准编辑、并且可以多图层分离、也可以生成高密度信息图了、并且可以原生生成多语种文字、还可以直出可编辑分层设计图。
这些对设计方向的朋友会很实用,以后如果我们想基于 AI 生成的图片,直接进行多图层分离、进一步编辑和修改,都会非常方便。对于电商方向,直出多语种文字也相当方便。
我现场看演示的图片效果,目前没有测试,暂时没有发言权。但我感觉至少比肩 Nano Banana 2 应该是没问题的了。
Seedance 2.0系列的4K模式这个好像发布了,以及Seedance 2.5也已经在预热了。2.0在1080P的时候已经是生产级模型了,现在4K指令更加精准、运动表现也有明显提升,可以满足更多商业向的需求,个人向玩的话真的会比较烧钱,但对于有创意和想法的创作者,这个能让自己的作品达到更极致的效果。
Seedance 2.5系列视频模型,预计也快和大家见面了,大概7月份。它主打最长30秒单段原生视频、最多可以50个全模态素材联合生成、一致性局部编辑。它有一个黑科技,会先生成3D白模再生成,它的重点已经从prompt视频走向多素材导演工作流了。
除了这两个以外,这次还发布了包括语音、音频、3D等方向的模型。
音频这个,音频作品生成的模型单次可以做到两分钟的完整的音频作品,并且支持完整的音轨生成。功能包括:可以通过文本加上参考音频进行输入,支持多角色对白,可以添加背景音乐、环境音效以及拟音。就这还只是1.0 ,真的太卷了。
另外还有音乐生成模型,已经可以在即梦体验了。
目前看来整个视频创作的链路都已经可以用它完全打通了。
接下来可能像即梦这样的平台就可以直接实现从生图、视频、配音,甚至后续的背景音乐,都通过一个平台或一个品牌的模型去从头到尾完成。他们真的下了好大一盘棋。
今天确实觉得很激动,我们也在见证国内的模型确实在一步步稳步前进,走得更好了。
期待能早早体验到这些模型,感受一下它们的实际效果。后续等我体验到我再继续分享了,期待大家再去看我的测评[嘿哈]
![]()
![]()
![]()
![]()
![]()
![]()
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.