中国电信发布全自研视频生成大模型
2024年12月06日 00:04
来源: 每日经济新闻
东方财富APP

方便,快捷

手机查看财经快讯

专业,丰富

一手掌握市场脉搏

手机上阅读文章

提示:

微信扫一扫

分享到您的

朋友圈

K图 601728_0]

K图 00728_0]

  12月2日至12月5日,“2024数字科技生态大会”在广州举办。其间,中国电信在首届“TeleAI开发者大会”上发布了视频生成大模型、视觉大模型产用一体化平台、具身智能、智传网等一系新品,成立不久的TeleAI研究院也一同亮相。

  《每日经济新闻》记者在现场了解到,此次中国电信发布的视频生成大模型为首个央企全自研视频生成大模型,打造了“VAST(Video As Storyboard from Text)二阶段视频生成技术”,可通过文本描述勾勒出包含视频构图、主体目标位置及人物姿态等关键信息的“故事板”(Storyboard),进而生成对应的视频内容。

  中国电信方面表示,得益于VAST的创新能力,视频生成大模型可以保证单个或多个主体人物在各视频片段中的外观一致性,实现对复杂动作和交互式动作的精确控制,并让角色和目标物体的运动符合物理规律。

  基于此,通过语义、语音、文生图、文生视频等全栈大模型能力打通短剧及影视制作的各个环节;覆盖文字脚本撰写、分镜脚本绘制、视频拍摄及剪辑、配音及音效合成等全流程,实现降本增效。

  除了视频生成大模型,中国电信还发布了基于知识的视图万物布控视觉大模型。根据中国电信的介绍,视觉大模型现已升级至TeleSearch 2.0—基于知识的视图万物布控,可实现动态知识挂载和行业事件认知,并驱动复杂逻辑理解。

  TeleSearch 2.0目标是打破模态间的信息孤岛,支持上百个专业知识文档挂载,在理解文档内容的基础上可根据复杂长语句精准检索图片和视频,从而完成跨模态复杂语义准确理解及超万种目标精准检索。

  依托TeleSearch 2.0,中国电信构建了视觉大模型产用一体化平台,通过算法冷启动回流数据,可实现0训练数据直接推理,并支持小样本训练。中国电信透露,目前该平台已成功应用于多省应急项目,沉淀了20余个应急全流程感知场景,提升对灾害研判与应急响应的核心能力。

(文章来源:每日经济新闻)

文章来源:每日经济新闻 责任编辑:137
原标题:中国电信发布全自研视频生成大模型
郑重声明:东方财富发布此内容旨在传播更多信息,与本站立场无关,不构成投资建议。据此操作,风险自担。
举报
分享到微信朋友圈

打开微信,

点击底部的“发现”

使用“扫一扫”

即可将网页分享至朋友圈

扫描二维码关注

东方财富官网微信


扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500