3.AI大模型数据库

Still-Moving:Google DeepMind 团队开发的一种创新视频生成框架

Still-Moving简介 Still-Moving 是由 Google DeepMind 团队开发的一种创新视频生成框架,它允许在无需定制视频数据的情况下,对文本到视频(T2V)模型进行个...

DeepSeek-Prover-V1.5:一个拥有70亿参数的开源数学大模型

DeepSeek-Prover-V1.5简介 DeepSeek-Prover-V1.5 是一个开源的数学大模型,拥有70亿参数。专为 Lean 4 中的定理证明而设计。它通过结合强化学习和蒙特卡洛树...

xGen-MM:Salesforce推出的一款开源多模态AI模型

xGen-MM简介 xGen-MM(原BLIP-3)是由Salesforce推出的一款开源的大型多模态模型(LMMs)。这些模型基于精心策划的数据集,采用统一的训练方法和优化的模型架...

Phi-3.5:微软最新推出的系列AI模型,包含三个模型

Phi-3.5简介 Phi-3.5是微软最新推出的系列AI模型,Phi-3.5系列包括三个模型:Phi-3.5-mini-instruct、Phi-3.5-MoE-instruct和Phi-3.5-vision-instruct,分别...

Seed-ASR:可识别不同语言、方言、口音的AI语音识别模型

Seed-ASR简介 Seed-ASR是由字节跳动的Seed团队开发的一款基于大型语言模型(LLM)的语音识别模型。它通过结合超过2亿参数的音频编码器和具有数十亿参数的专家...

TurboEdit:可通过文本提示来实时指导图像的编辑

TurboEdit简介 TurboEdit是由Adobe Research开发的一项创新技术,它通过引入基于编码器的迭代反演技术和条件化处理,实现了对图像的精确反演和解耦图像编辑。...

FancyVideo:跨帧文本引导的动态一致视频生成模型

FancyVideo简介 FancyVideo 是由360和中山大学共同开发的一款创新视频生成模型。它通过引入跨帧文本引导模块(Cross-frame Textual Guidance Module, CTGM)...

Llama-3.1-Minitron:英伟达推出的仅4B参数的小型语言模型

Llama-3.1-Minitron简介 Llama-3.1-Minitron是由英伟达公司利用先进的剪枝和知识蒸馏技术,从Llama 3.1 8B模型中提炼而成的4B参数小型语言模型。它在保持与更...

LongWriter:将现有模型的文本生成能力扩展到超过10,000字

LongWriter项目简介 LongWriter是由清华大学与智谱AI联合开发的一项创新技术,旨在突破当前大型语言模型(LLMs)在生成长文本方面的限制。通过引入AgentWrite...

Tavus:支持数字人克隆和实时对话的AI视频生成平台

Tavus简介 Tavus 是一个先进的AI视频生成平台,它支持数字人克隆和实时对话功能。这个平台基于Phoenix-2模型和对话式视频接口(CVI),能够实现接近人类的自...
1 13 14 15 16 17 20