迄今最大视频开源模型！腾讯混元文生视频上线：一句话生成视频

休闲 2024-12-27 00:56:08 151

12月3日消息，迄今今日，视频视频上线生成视频腾讯混元大模型宣布文生视频功能上线，开源一句话就能生成视频。模型

此次开源的腾讯视频生成大模型，参数量130亿，混元是文生当前最大的视频开源模型。

目前，句话该模型已在Hugging Face平台及Github上发布，迄今包含模型权重、视频视频上线生成视频推理代码、开源模型算法等完整模型，模型可供企业与个人开发者免费使用和开发生态插件。腾讯

大家可在腾讯元宝APP-AI应用-AI视频中提交申请试用，混元企业客户可通过腾讯云提供服务接入，文生API同步开放内测申请。

据了解，目前生成视频支持中英文双语输入、多种视频尺寸以及多种视频清晰度。

腾讯混元视频生成大模型可以生成超写实的高质量视频，比如，像冲浪、跳舞这种大动作场景，生成的画面自然合理，不容易变形。

在镜面或镜子场景中，可以做到镜面反射动作和外面完全同步，光影反射基本符合物理规律。

据腾讯介绍，腾讯混元视频生成大模型采用DiT架构，并在架构设计上进行多处升级。

适配了新一代文本编码器提升语义遵循，其具备强大的语义跟随能力，更好地应对多个主体描绘，实现更加细致的指令和画面呈现。

通过先进的图像视频混合VAE（3D变分编码器），让模型在细节表现有明显提升，特别是小人脸、高速镜头等场景。

本文仅代表作者观点，不代表本站立场。
本文系作者授权发表，未经许可，不得转载。

津媒：津门虎冬训逐渐上量，哈达斯、阿代米定归队时间直飞海口

[流言板]德杯八强赛赛程：24号晚七点iG对阵TES，23号17点EDG对阵WBG

曹缘、郭崎琪谈奥运夺金：战胜伤病破茧成蝶

继退市、裁员后广汇汽车又雪上加霜：被强制执行10.4亿元

ASML CEO：美国造半导体光有钱不够

《恐怖之森：森淵》登陆Steam 经典恐怖逃生新作

真我14 Pro+亮相：首发温感变色技术后盖遇冷变色

辽宁客场输吉林另有蹊跷？