生数科技
0

生数科技

多模态大模型,融合文本,图像,视频,语音,3D等多模态信息

链接直达

北京生数科技有限公司(简称“生数科技”)成立于2023年3月,核心团队成员来自清华大学人工智能研究院,此外汇集了来自阿里、腾讯、字节等知名科技公司的顶尖人才,是全球范围内领先的深度生成式算法研究团队,拥有扩散概率模型底层创新研发能力。公司致力打造世界领先的多模态大模型,融合文本、图像、视频、语音、3D等多模态信息,探索生成式AI在艺术设计、游戏制作、影视后期、内容社交等场景的商业赋能,通过AI提升人类的创造力和生产力。

生数科技官网网址:https://www.shengshu-ai.com/

生数科技插图

生数科技是一家成立于2023年3月的公司,专注于生成式人工智能(AI)基础设施及应用建设。公司由清华大学人工智能研究院的核心团队创立,核心成员包括清华人工智能研究院副院长朱军教授和前瑞莱智慧副总裁唐家渝担任CEO。生数科技致力于打造可控多模态通用大模型,通过生成式AI技术提升人类的创造力与生产力。

生数科技在多模态大模型领域取得了显著成就,提出了基于Transformer架构的U-ViT融合框架,并开源了UniDiffuser模型,实现了高质量的图文联合生成、视频生成等多种任务。此外,公司还发布了中国首个长时长、高一致性、高动态性的视频大模型Vidu,该模型能够根据文本描述生成长达16秒、分辨率达1080P的高清视频内容。

生数科技已完成多轮融资,包括近亿元人民币的天使轮融资和数亿元人民币的Pre-A轮融资,投资方包括蚂蚁集团、BV百度风投、启明创投等知名机构。公司计划继续深化在通用多模态大模型方向的探索,并加速产品开发与市场拓展。

生数科技凭借其强大的技术研发能力和丰富的行业经验,在多模态大模型领域处于领先地位,并有望成为全球领先的AI企业之一。

相关推荐

Grsai API

Grsai聚合了各种优秀的主流图片与视频生成大模型,以低于官网好几倍的价格为您降低使用成本!提供企业级专业稳定的API中转站,服务稳定可靠,达到99.99%。

LMArena

一个与人工智能(AI)模型评估和比较相关的平台,其核心功能是通过用户投票和社区参与的方式,对大型语言模型(LLM)进行评测和排名。

H

Hallo 是一个由复旦大学(Fudan University)开发的开源项目,专注于音频驱动的视觉合成技术,特别是用于人像动画生成。

M

MuseTalk 是一个实时高质量音频驱动唇形同步模型,旨在解决高分辨率、身份一致性和准确唇形同步的面部视觉配音挑战,尤其适用于实时应用如直播视频 。

S

SadTalker 是一个基于单张图像和音频生成说话人脸视频的模型,其核心功能是通过音频输入使静态图片中的图像动起来,并生成说话的虚拟人物。

评论

暂无评论,来抢沙发~