跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

195条精选相关主题产品更新论文研究开源生态

最新精选

第 181–195 条 · 共 195 条
3月6日周一
10月5日周三
  1. Hugging Face60

    rinna 发布 Japanese Stable Diffusion:面向日语文化的文生图模型

    rinna 正式发布日语文生图模型 Japanese Stable Diffusion,支持直接输入日语提示词生成符合日本文化与表达习惯的图像。该模型在约 1 亿带有日文说明的图文数据上微调,通过引入日语分词器并分阶段联合训练文本编码器与潜在扩散模型,模型与代码已在 Hugging Face 和 GitHub 开源。

    推荐理由:文章详细拆解了如何用两阶段微调将英文扩散模型迁移至小样本小语种,为本土化文生图适配提供了清晰方法。

9月21日周三
  1. OpenAI83

    OpenAI 开源语音识别模型 Whisper

    OpenAI 宣布开源名为 Whisper 的神经网络模型,该模型在英语语音识别上达到了接近人类水平的鲁棒性与准确度。

    推荐理由:OpenAI 开源了语音识别模型 Whisper,在英语语音识别任务上达到了接近人类水平的鲁棒性与准确度。

7月12日周二
3月15日周二
  1. OpenAI75

    OpenAI 为 GPT-3 与 Codex 推出文本编辑与插入功能

    OpenAI 发布了 GPT-3 和 Codex 的新版本,新增在现有文本中编辑或插入内容的功能。这项更新让两款模型不再局限于顺向补全现有文本,能够直接对已有内容进行修改和填充。

    推荐理由:新版本改变了此前只能顺向补全文本的工作模式,允许开发者直接在现有文本中进行针对性编辑与内容插入。

1月27日周四
  1. OpenAI91

    OpenAI 推出 InstructGPT 模型以改进指令遵循能力

    OpenAI 推出 InstructGPT 模型并将其部署为 API 上的默认语言模型。该模型基于对齐研究并采用人类在环训练,相比 GPT-3 能够更好地遵循用户意图,同时表现出更高的真实性并降低了有害内容输出。

    推荐理由:原文给出了通过对齐研究训练 InstructGPT 并替代 GPT-3 成为 API 默认模型的实践,读者可据此了解模型遵循意图与降低毒性的改进路径。

8月10日周二
1月5日周二
4月30日周四
  1. OpenAI75

    OpenAI 推出音乐生成模型 Jukebox 并开源代码与权重

    OpenAI 推出音乐生成神经网络 Jukebox,能够以原始音频形式生成涵盖多种流派和艺术家风格的音乐,并包含基础的人声演唱。官方同时开源了模型权重与代码,并提供了用于浏览和试听生成音频样本的工具。

    推荐理由:该模型直接以原始音频形式生成音乐与歌声,并开放了代码与权重供社区探索。

11月5日周二
  1. OpenAI86

    OpenAI 发布 GPT-2 1.5B 最大参数版本及权重

    OpenAI 正式发布 GPT-2 分阶段发布的最终版本,公开了拥有 1.5B 参数的最大版本模型、代码与模型权重。团队同时提供模型以辅助检测生成内容,希望为未来更强大模型的负责任发布流程提供完整的测试案例。

    推荐理由:OpenAI 完整走完分阶段发布流程并开放 1.5B 权重,为大模型负责任发布与生成内容检测提供了参考样本。

8月20日周二
  1. OpenAI72

    OpenAI 发布 774M 参数 GPT-2 模型及阶段性进展

    OpenAI 正式发布拥有 774M 参数的 GPT-2 语言模型。这是继 2 月发布 124M 小型模型与 5 月分阶段发布 355M 中型模型之后,结合潜在滥用与社会效益研究所推进的新版本;团队还同时开源了一份促进机构间模型共享合作的法律协议,并发布了关于协调 AI 研究社区发布规范的技术报告。

    推荐理由:OpenAI 推进其分阶段发布策略并公开 774M 参数模型,同时给出了与科研社区协作探讨发布规范的技术报告。

4月25日周四
  1. OpenAI69

    OpenAI 推出音乐生成模型 MuseNet

    OpenAI 推出深度神经网络 MuseNet,可使用 10 种不同乐器生成 4 分钟的音乐作品,并融合乡村音乐、莫扎特以及披头士等多样风格。该模型没有经过显式的音乐规则编程,而是采用与 GPT-2 相同的通用无监督 Transformer 架构,通过在数十万个 MIDI 文件中学习预测下一个 token 来掌握和声、节奏与音乐风格。

    推荐理由:该成果展示了将文本序列建模方法直接迁移至符号音乐生成的实现路径,体现了早期大模型架构的通用泛化潜力。

2月14日周四
  1. OpenAI78

    OpenAI 探讨更优质语言模型的能力与潜在影响

    OpenAI 训练了一个大规模无监督语言模型,能在无需特定任务训练的情况下生成连贯段落,并在多个语言建模基准上取得 SOTA 表现。该模型同时具备执行初步阅读理解、机器翻译、问答和摘要的能力。

    推荐理由:该成果展示了大规模无监督预训练在无需微调下直接泛化到多种下游任务的潜力。

7月9日周一
  1. OpenAI71

    OpenAI 推出可逆生成模型 Glow

    OpenAI 推出可逆生成模型 Glow,采用可逆 1x1 卷积简化了此前可逆生成模型的架构。该模型能够生成逼真的高分辨率图像,支持高效采样,并能提取可用于操控数据属性的特征。OpenAI 同步开源了模型代码并提供在线可视化工具。

    推荐理由:原文介绍了基于可逆卷积的生成模型 Glow 及其架构简化,读者可以了解基于流的生成模型与属性操纵方法。

6月25日周一