迄今最大视频开源模型!腾讯混元文生视频上线:一句话生成视频
时间:2024-12-29 12:08:13 来源:尊师贵道网 作者:时尚 阅读:446次
12月3日消息,迄今今日,视频视频上线生成视频腾讯混元大模型宣布文生视频功能上线,开源一句话就能生成视频。模型
此次开源的腾讯视频生成大模型,参数量130亿,混元是文生当前最大的视频开源模型。
目前,句话该模型已在Hugging Face平台及Github上发布,迄今包含模型权重、视频视频上线生成视频推理代码、开源模型算法等完整模型,模型可供企业与个人开发者免费使用和开发生态插件。腾讯
大家可在腾讯元宝APP-AI应用-AI视频中提交申请试用,混元企业客户可通过腾讯云提供服务接入,文生API同步开放内测申请。
据了解,目前生成视频支持中英文双语输入、多种视频尺寸以及多种视频清晰度。
腾讯混元视频生成大模型可以生成超写实的高质量视频,比如,像冲浪、跳舞这种大动作场景,生成的画面自然合理,不容易变形。
在镜面或镜子场景中,可以做到镜面反射动作和外面完全同步,光影反射基本符合物理规律。
据腾讯介绍,腾讯混元视频生成大模型采用DiT架构,并在架构设计上进行多处升级。
适配了新一代文本编码器提升语义遵循,其具备强大的语义跟随能力,更好地应对多个主体描绘,实现更加细致的指令和画面呈现。
通过先进的图像视频混合VAE(3D变分编码器),让模型在细节表现有明显提升,特别是小人脸、高速镜头等场景。
(责任编辑:时尚)
最新内容
热点内容
- ·3DS《星之卡比:机器人星球》或将登陆Switch
- ·马杜埃凯:准备好了面对冠军竞争但专注于自己 马雷斯卡值得信任
- ·俄军三防部队司令死于乌方暗杀? 梅德韦杰夫誓言报复
- ·电讯报:三分之二曼联球迷反对涨价,抨击拉爵在利用球迷忠诚
- ·降维打击!国安球员冯博轩参加体育院校锦标赛,半场梅开二度
- ·奇瑞iCAR V23开启交付:中高配车型率先登场 入门版明年3月亮相
- ·塞雷佐:参加新世俱杯是所有马竞球迷的骄傲,我们在一个复杂小组
- ·随时随地 充满能量 飞利浦 “能量块”五合一充电宝新品来袭
- ·[流言板]JDG发布人员变动公告:打野选手Kanavi正式离队
- ·西媒:皇马更衣室担忧姆巴佩的信心问题 他训练很好但比赛就消沉