中国电信发布全自研视频生成大模型_中国电信(601728)股吧

股吧首页 > 中国电信吧 > 正文

最近访问：

中国电信吧

返回中国电信吧>>

- 重要股东股权质押数据全览

中国电信资讯

发表于 2024-12-06 06:23:20 股吧网页版

中国电信发布全自研视频生成大模型

来源：每日经济新闻

　　12月2日至12月5日，“2024数字科技生态大会”在广州举办。其间，中国电信在首届“TeleAI开发者大会”上发布了视频生成大模型、视觉大模型产用一体化平台、具身智能、智传网等一系新品，成立不久的TeleAI研究院也一同亮相。

　　《每日经济新闻》记者在现场了解到，此次中国电信发布的视频生成大模型为首个央企全自研视频生成大模型，打造了“VAST（Video As Storyboard from Text）二阶段视频生成技术”，可通过文本描述勾勒出包含视频构图、主体目标位置及人物姿态等关键信息的“故事板”（Storyboard），进而生成对应的视频内容。

　　中国电信方面表示，得益于VAST的创新能力，视频生成大模型可以保证单个或多个主体人物在各视频片段中的外观一致性，实现对复杂动作和交互式动作的精确控制，并让角色和目标物体的运动符合物理规律。

　　基于此，通过语义、语音、文生图、文生视频等全栈大模型能力打通短剧及影视制作的各个环节；覆盖文字脚本撰写、分镜脚本绘制、视频拍摄及剪辑、配音及音效合成等全流程，实现降本增效。

　　除了视频生成大模型，中国电信还发布了基于知识的视图万物布控视觉大模型。根据中国电信的介绍，视觉大模型现已升级至TeleSearch 2.0—基于知识的视图万物布控，可实现动态知识挂载和行业事件认知，并驱动复杂逻辑理解。

　　TeleSearch 2.0目标是打破模态间的信息孤岛，支持上百个专业知识文档挂载，在理解文档内容的基础上可根据复杂长语句精准检索图片和视频，从而完成跨模态复杂语义准确理解及超万种目标精准检索。

　　依托TeleSearch 2.0，中国电信构建了视觉大模型产用一体化平台，通过算法冷启动回流数据，可实现0训练数据直接推理，并支持小样本训练。中国电信透露，目前该平台已成功应用于多省应急项目，沉淀了20余个应急全流程感知场景，提升对灾害研判与应急响应的核心能力。

（文章来源：每日经济新闻） [点击查看原文]

郑重声明：用户在财富号/股吧/博客等社区发表的所有信息（包括但不限于文字、视频、音频、数据及图表）仅代表个人观点，与本网站立场无关，不对您构成任何投资建议，据此操作风险自担。请勿相信代客理财、免费荐股和炒股培训等宣传内容，远离非法证券活动。请勿添加发言用户的手机号码、公众号、微博、微信及QQ等信息，谨防上当受骗！

评论该主题

帖子不见了！怎么办？

作者：您目前是匿名发表登录 | 5秒注册作者：，欢迎留言退出发表新主题

郑重声明：用户在社区发表的所有资料、言论等仅代表个人观点，与本网站立场无关，不对您构成任何投资建议。用户应基于自己的独立判断，自行决定证券投资并承担相应风险。《东方财富社区管理规定》