今日,腾讯混元大模型宣布文生视频功能上线,一句话就能生成视频。
此次开源的视频生成大模型,参数量130亿,是当前最大的视频开源模型。
目前,该模型已在Hugging Face平台及Github上发布,包含模型权重、推理代码、模型算法等完整模型,可供企业与个人开发者免费使用和开发生态插件。
大家可在腾讯元宝APP-AI应用-AI视频中提交申请试用,企业客户可通过腾讯云提供服务接入,API同步开放内测申请。
据了解,目前生成视频支持中英文双语输入、多种视频尺寸以及多种视频清晰度。
腾讯混元视频生成大模型可以生成超写实的高质量视频,比如,像冲浪、跳舞这种大动作场景,生成的画面自然合理,不容易变形。
在镜面或镜子场景中,可以做到镜面反射动作和外面完全同步,光影反射基本符合物理规律。
据腾讯介绍,腾讯混元视频生成大模型采用DiT架构,并在架构设计上进行多处升级。
适配了新一代文本编码器提升语义遵循,其具备强大的语义跟随能力,更好地应对多个主体描绘,实现更加细致的指令和画面呈现。
通过先进的图像视频混合VAE(3D变分编码器),让模型在细节表现有明显提升,特别是小人脸、高速镜头等场景。
文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。
12 月 3 日消息,公开信息显示,美团关联公司北京三快科技有限公司因未对平台商户证照资质进行真实性审查,被北京市市场监督管理局罚款 20 万元,没收违法所得约 46 万元。
奥维云网(AVC)推总数据显示,2024年1-9月明火炊具线上零售额94.2亿元,同比增加3.1%,其中抖音渠道表现优异,同比有14%的涨幅,传统电商略有下滑,同比降低2.3%。
“以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。
华硕ProArt创艺27 Pro PA279CRV显示器,凭借其优秀的性能配置和精准的色彩呈现能力,为您的创作工作带来实质性的帮助,双十一期间低至2799元,性价比很高,简直是创作者们的首选。