搜索
APP下载
扫码下载APP
关注我们
XHS
小红书
抖音
Facebook
X
YouTube
登录
注册
首页
热点资讯
互动论坛
同城服务
人才网
实用工具
搜索
每日签到
本地新闻
时事评论
华人世界
斯里兰卡资讯
中国新闻
新闻视频
国际新闻
娱乐新闻
科技新闻
菲龙广场
本地新闻
全网热搜
华人世界
时事评论
中外新闻
斯里兰卡资讯
房产网
菲龙速聘
二手交易
便民电话
美食餐厅
旅游签证
物流速运
商品买卖
二手车市场
支票转换
便民电话
话费充值
实时汇率
每日签到
我的任务
道具商店
菲龙网
»
论坛
›
新闻频道
›
中国新闻
›
中国首个Sora级视频大模型Vidu发布
菲龙网管理员8
有 237 人收听 TA
78474
主题
78928
回复
99924
积分
收听TA
发消息
加好友
本文来自
中国新闻
订阅
|
收藏
(
2955
)
菲龙网管理员8发布过的帖子
0/117
新疆启动三项重大科技项目 构建沙漠—农田防护完整技术链条
0/88
总书记的关切·落地的回响|中国式现代化要靠科技现代化作支撑
0/130
中国经济开局良好 外媒:高质量发展助力中国经济更具可持续性
0/120
从“一场演出”到“一次奔赴” 新疆深耕服务消费新蓝海
0/114
外籍记者方浩明观赛机器人马拉松:“中国机器人给世界开了个好头”
0/105
评论:台湾社会愈加期待两岸和平与交流
0/104
经济热点快评|创新这场“马拉松”,没有终点
0/113
“读圣贤书,所学何事?”——杜鹃花开时再读文天祥
0/123
在与书为伴的日子里(人文观察)
查看TA的全部帖子>>
中国首个Sora级视频大模型Vidu发布
时间:2024-4-28 10:20
0
559
|
复制链接
|
互动交流
显示全部楼层
阅读模式
直达楼层
马上注册,结交更多好友
您需要
登录
才可以下载或查看,没有账号?
立即注册
x
中新社北京4月27日电:
(记者 陈溯)在2024中关村论坛年会未来人工智能先锋论坛上,清华大学联合生数科技27日正式发布中国首个长时长、高一致性、高动态性视频大模型——Vidu。
该模型采用团队原创的Diffusion与Transformer融合的架构U-ViT,支持一键生成长达16秒、分辨率高达1080P的高清视频内容。
4月27日,在2024中关村论坛年会未来人工智能先锋论坛上,清华大学联合生数科技正式发布Vidu。 中新社记者 陈溯 摄
据介绍,Vidu不仅能够模拟真实物理世界,还拥有丰富想象力,具备多镜头生成、时空一致性高等特点。Vidu是自Sora发布之后全球率先取得重大突破的视频大模型,性能全面对标国际顶尖水平,并在加速迭代提升中。
在当天的论坛上,清华大学教授、生数科技首席科学家朱军表示,与Sora一致,Vidu能够根据提供的文本描述直接生成长达16秒的高质量视频。除了在时长方面的突破外,Vidu在视频效果方面实现显著提升,主要体现在模拟真实物理世界、多镜头语言、时空一致性高、理解中国元素等方面。
4月27日,在2024中关村论坛年会未来人工智能先锋论坛上,清华大学联合生数科技正式发布Vidu。Vidu在视频效果方面实现显著提升,能够生成特有的中国元素,例如熊猫、龙。 中新社记者 陈溯 摄
“值得一提的是,Vidu采用的是‘一步到位’的生成方式。”朱军表示,与Sora一样,文本到视频的转换是直接且连续的,在底层算法实现上是基于单一模型完全端到端生成,不涉及中间的插帧和其他多步骤的处理。
朱军表示,Vidu的快速突破源自于团队在贝叶斯机器学习和多模态大模型的长期积累和多项原创性成果。其核心技术U-ViT架构由团队于2022年9月提出,早于Sora采用的DiT架构,是全球首个Diffusion与Transformer融合的架构,完全由团队自主研发。
自今年2月Sora发布推出后,团队基于对U-ViT架构的深入理解以及长期积累的工程与数据经验,在短短两个月进一步突破长视频表示与处理关键技术,研发推出Vidu视频大模型,显著提升视频的连贯性与动态性。
“Vidu的命名不仅谐音‘Vedio’,也蕴含‘We do’的寓意。”朱军表示,模型的突破是一个多维度、跨领域的综合性过程,需要技术与产业应用的深度融合,希望与产业链上下游企业、研究机构加强合作,共同推动视频大模型进展。(完)
回复
举报
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
点我进行验证
本版积分规则
发表回复
回帖后跳转到最后一页
扫码添加微信客服
快速回复
返回列表
返回顶部