可灵大模型
0

可灵大模型

由快手AI团队自研打造的视频生成大模型

链接直达

可灵大模型是由快手AI团队自研打造的视频生成大模型,具备强大的视频生成能力。该模型采用了3D时空联合注意力机制,能够生成长达2分钟、分辨率为1080p、帧率为30fps的高质量视频,并支持多种宽高比。可灵大模型能够模拟真实物理世界特性,生成大幅度的合理运动,并具备强大的概念组合能力和想象力。

可灵大模型官网网址:https://kling.kuaishou.com/

可灵大模型插图

此外,可灵大模型还推出了图生视频功能,支持将任意静态图像转化为5秒动态视频,并且可以搭配不同的文本内容,实现丰富的视觉叙事。同时,可灵还发布了视频续写功能,支持对已生成的视频进行一键续写和连续多次续写,将视频最长可延伸至约3分钟。

可灵大模型已在快手旗下的快影App开放邀测体验,用户可以通过该应用体验其先进的视频生成功能。

相关推荐

Grsai API

Grsai聚合了各种优秀的主流图片与视频生成大模型,以低于官网好几倍的价格为您降低使用成本!提供企业级专业稳定的API中转站,服务稳定可靠,达到99.99%。

LMArena

一个与人工智能(AI)模型评估和比较相关的平台,其核心功能是通过用户投票和社区参与的方式,对大型语言模型(LLM)进行评测和排名。

H

Hallo 是一个由复旦大学(Fudan University)开发的开源项目,专注于音频驱动的视觉合成技术,特别是用于人像动画生成。

M

MuseTalk 是一个实时高质量音频驱动唇形同步模型,旨在解决高分辨率、身份一致性和准确唇形同步的面部视觉配音挑战,尤其适用于实时应用如直播视频 。

S

SadTalker 是一个基于单张图像和音频生成说话人脸视频的模型,其核心功能是通过音频输入使静态图片中的图像动起来,并生成说话的虚拟人物。

评论

暂无评论,来抢沙发~