迄今最大视频开源模型!腾讯混元文生视频上线:一句话生成视频

热点 2024-12-29 14:37:34 81

12月3日消息,迄今今日,视频视频上线生成视频腾讯混元大模型宣布文生视频功能上线,开源一句话就能生成视频。模型

此次开源的腾讯视频生成大模型,参数量130亿,混元是文生当前最大的视频开源模型。

迄今最大视频开源模型!腾讯混元文生视频上线:一句话生成视频

目前,句话该模型已在Hugging Face平台及Github上发布,迄今包含模型权重、视频视频上线生成视频推理代码、开源模型算法等完整模型,模型可供企业与个人开发者免费使用和开发生态插件。腾讯

大家可在腾讯元宝APP-AI应用-AI视频中提交申请试用,混元企业客户可通过腾讯云提供服务接入,文生API同步开放内测申请。

据了解,目前生成视频支持中英文双语输入、多种视频尺寸以及多种视频清晰度。

腾讯混元视频生成大模型可以生成超写实的高质量视频,比如,像冲浪、跳舞这种大动作场景,生成的画面自然合理,不容易变形。

在镜面或镜子场景中,可以做到镜面反射动作和外面完全同步,光影反射基本符合物理规律。

据腾讯介绍,腾讯混元视频生成大模型采用DiT架构,并在架构设计上进行多处升级。

适配了新一代文本编码器提升语义遵循,其具备强大的语义跟随能力,更好地应对多个主体描绘,实现更加细致的指令和画面呈现。

通过先进的图像视频混合VAE(3D变分编码器),让模型在细节表现有明显提升,特别是小人脸、高速镜头等场景。

本文地址:http://p5fmp.ahlulin.com/html/16d01799966.html
版权声明

本文仅代表作者观点,不代表本站立场。
本文系作者授权发表,未经许可,不得转载。

全站热门

Joy啊 以后解说的时候少提那个队伍 别搭理 犯不着

[流言板]76人战胜黄蜂避免两连败,目前战绩8胜16负继续位居东部第12

都体:尤文有意先租后买里昂前锋米卡乌塔泽,总价约2000万欧

2025世俱杯抽签规则:欧洲队为前两档,其他洲同联赛球队不能同组

加兰:多次在最后时刻进球绝非偶然 还有很长路要走必须保持态度

这场媒体盛会上,中国新闻网收获四项荣誉

[流言板]宋翔:中国球员实力不足以打动NBA,逐梦路还需付出更多努力

津媒:U20国足亚洲杯赛程先易后难,久尔杰维奇将优化最强阵容

友情链接