最新精选
第 221–240 条 · 共 284 条OpenAI 在 DevDay 开发者大会上发布 GPT-4 Turbo,支持 128K 上下文窗口且调用价格更低。本次更新还同步推出了 Assistants API、具备视觉理解能力的 GPT-4 Turbo with Vision 以及 DALL·E 3 API 等多项开发者工具。
推荐理由:OpenAI 在 DevDay 发布支持 128K 上下文且价格更低的 GPT-4 Turbo 与 Assistants API,集中更新了模型与开发者工具。
Hugging Face 研究团队复现了 OpenAI 2019 年的 RLHF 代码库,并发布了开源复现代码与工程实现细节清单。文章拆解了奖励模型归一化、拒绝采样、每步 KL 惩罚等机制,重点发现 PyTorch 与 TensorFlow 在 Adam 优化器公式实现上的差异会导致 PyTorch 在训练初期梯度更新过于激进,并在较大模型中引发严重的 KL 散度震荡。
推荐理由:文章拆解了复现早期RLHF算法的核心工程细节,指出了PyTorch与TensorFlow优化器差异对训练稳定性的影响。
OpenAI 宣布 DALL·E 3 正式向 ChatGPT Plus 和 Enterprise 用户开放。团队构建了多层安全缓解措施以支持更广泛的上线,并同步公开了在内容来源溯源研究方面的最新进展。
推荐理由:OpenAI 将图像生成模型接入付费版 ChatGPT,同时展示了支持规模化上线的安全防护与来源追溯方案。
OpenAI 宣布 ChatGPT 推出视觉与语音能力,模型现已能够看、听和说话。
OpenAI 面向在课堂中使用 ChatGPT 的教师发布了一份官方指南。该指南提供了建议提示词、ChatGPT 的工作原理与其局限性说明,并讨论了 AI 检测工具的有效性及模型偏见问题。
推荐理由:OpenAI 官方为教育工作者梳理了提示词与局限性,教师可以参考其建议规避检测器误判与模型偏见问题。
OpenAI 正式推出 ChatGPT Enterprise,主打企业级安全与隐私保护,并提供当时性能最强的 ChatGPT 版本。
OpenAI 宣布推出 GPT-3.5 Turbo 微调功能与 API 更新。开发者现在可以使用自有数据,针对特定使用场景定制 GPT-3.5 Turbo 模型。
OpenAI 采用 GPT-4 辅助内容审核决策与审核规则开发。该方案能够实现更一致的内容标注,缩短规则迭代的反馈周期,同时减少人工审核员的直接介入。
推荐理由:介绍将大语言模型引入内容审核与规则制定的实践路径,为降低人工审核负担和加速规则迭代提供了参考。
OpenAI 宣布为 ChatGPT 推出自定义指令(custom instructions)功能,让用户能够更灵活地控制模型的回复方式。用户只需预先设定个人偏好,ChatGPT 便会在未来的所有对话中持续遵循这些要求。
推荐理由:该功能允许用户预先设定交互偏好并在后续对话中全局生效,读者可以借此减少重复输入背景提示词的成本。
OpenAI 训练模型通过奖励每个正确的推理步骤(过程监督)而非仅奖励最终答案(结果监督),在数学问题求解中达到 SOTA 水平。相比结果监督,过程监督不仅显著提升了模型性能,还能直接引导模型生成人类认可的思维链,带来重要的对齐收益。
推荐理由:研究对比了过程监督与结果监督在数学推理上的差异,展示了逐步奖励思维链对解题性能和模型对齐的双重价值。
OpenAI 旗下非营利机构推出专项资助计划,将发放 10 笔每笔 100,000 美元的资金。该资助旨在支持相关实验,探索在法律允许的范围内通过民主流程决定 AI 系统应当遵循的规则。
推荐理由:OpenAI 设立资助金探索 AI 规则制定流程,为观察模型行为准则如何引入外部公众参与机制提供了实验样本。
OpenAI 正式推出 iOS 版 ChatGPT 应用。该应用支持同步用户的对话记录,具备语音输入功能,并将最新的模型改进直接集成到移动端。
OpenAI 宣布 ChatGPT 用户现可关闭聊天历史记录,允许用户自主选择哪些对话数据可用于训练官方模型。
推荐理由:用户可以通过关闭聊天历史自主控制对话是否用于模型训练,为关注数据隐私的个人与团队提供了基础控制权。
OpenAI 针对 3 月 20 日发生的 ChatGPT 宕机事件发布调查说明。文中公布了团队目前的调查发现、已采取的应对措施以及该漏洞的技术细节。
OpenAI 宣布在 ChatGPT 中初步支持插件功能。插件是专为大语言模型设计且以安全为核心原则的工具,可帮助 ChatGPT 访问最新信息、执行计算以及调用第三方服务。
推荐理由:OpenAI 推出插件机制让大模型接入外部工具,扩展了获取最新信息、执行计算与调用第三方服务的能力。
OpenAI 宣布推出大型多模态模型 GPT-4,支持图像和文本输入并生成文本输出。官方表示该模型是其深度学习扩展工作的最新里程碑,虽然在许多真实世界场景中表现仍不及人类,但在各项专业和学术基准测试中展现出人类水平。
推荐理由:OpenAI 推出支持图文输入的多模态模型 GPT-4,其在专业和学术基准上的表现展示了扩展深度学习的能力边界。
OpenAI 推出 GPT-4。该模型支持在创意与技术写作任务中与用户协同生成、编辑和迭代,涵盖创作歌曲、编写剧本以及学习用户的写作风格。
OpenAI 推出了一款经过专门训练的分类器,用于区分 AI 生成的文本与人类撰写的文本。
OpenAI 宣布与 Microsoft 延长合作伙伴关系。
OpenAI 宣布 DALL·E API 正式进入公开测试阶段。从即日起,开发者可以通过该 API 开始构建应用程序。