Meta 开源预训练 Transformer 系列模型(125M~175B),复现 GPT-3 级性能并公开训练细节。
- 模型类型
- foundation
- 发布日期
- 2022/5/3
硅基参考模型库记录 VLA、VLM、策略模型、扩散策略与控制模型的组织、模态、硬件支持与论文关系,便于按能力路线检索。
Meta 开源预训练 Transformer 系列模型(125M~175B),复现 GPT-3 级性能并公开训练细节。
xAI 大语言模型系列,集成 X 平台实时数据,强调幽默与实时信息能力。
Google DeepMind 视觉-语言-动作机器人基础模型,基于 Gemini 2.0,支持灵巧操作与少样本适配。
Google 双向 Transformer 预训练语言表示模型,刷新 11 项 NLP 任务纪录。
OpenAI 对比式视觉-语言预训练模型,4 亿图文对训练,支持零样本图像分类。
OpenAI 开源语音识别模型,68 万小时多语言数据训练,支持 99 语言转录与翻译。
Google DeepMind 视觉-语言-动作模型,将 VLM 与机器人控制统一为 token 预测。
OpenAI 文生图扩散模型,结合 CLIP 文本嵌入与扩散解码器生成高分辨率图像。
Google下一代 Pathways 语言模型,多语言与推理能力增强,驱动 Bard 与 Duet AI。
Google Robotics Transformer,在 13 万真实轨迹 700+ 任务上实现机器人控制泛化。
DeepMind 围棋 AI,结合深度神经网络与蒙特卡洛树搜索,首次击败职业人类棋手。
DeepMind 蛋白质结构预测模型,在 CASP14 达原子级精度,破解 50 年蛋白质折叠难题。
OpenAI 文生视频模型,基于 DiT 架构生成最长 60 秒高保真视频。
Stability AI 开源潜在扩散文生图模型,在 LAION-5B 上训练,可在消费级 GPU 上运行。
DeepMind 70B 参数计算最优语言模型,1.4 万亿 token 训练,超越 Gopher 280B 与 GPT-3。
Google DeepMind 原生多模态大模型,支持文本、图像、音频与视频输入。
OpenAI 1750 亿参数自回归语言模型,首次展现大规模上下文学习能力。
Anthropic 对话助手系列,基于 Constitutional AI 训练,强调 HH&H 对齐。
Meta 开源可商用大语言模型,含 7B/13B/70B 参数变体,2 万亿 token 训练。
OpenAI 多模态大模型,接受图文输入输出文本,在多项专业考试达人类前 10%。