跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

156条精选相关主题模型发布行业动态AI 编码

最新精选

第 41–60 条 · 共 156 条
5月17日周日
  1. Google DeepMind66

    Google DeepMind 推出 Gemini for Science 科学研究 AI 工具集

    Google DeepMind 推出科学工具与实验集合 Gemini for Science,旨在通过通用智能体加速科研探索。套件在 Google Labs 推出三项实验工具,涵盖基于 Co-Scientist 的假设生成、基于 AlphaEvolve 与 ERA 的并行计算发现,以及基于 NotebookLM 的文献结构化洞察。

    推荐理由:文章详细梳理了多智能体与算法工具在假说生成、计算实验与文献分析中的具体机制,展现了AI介入科研全流程的工程路径。

5月15日周五
  1. OpenAI66

    ChatGPT 推出全新个人财务体验

    OpenAI 在 ChatGPT 中推出全新个人财务体验。用户可关联个人账户以追踪日常支出与投资情况,并支持管理订阅服务、制定预算以及规划财务目标。

    推荐理由:原文列出了关联账户与追踪投资等功能,读者可据此了解 ChatGPT 在个人财务场景的具体能力范围。

5月14日周四
  1. OpenAI62

    OpenAI 支持在 ChatGPT 移动端使用 Codex

    OpenAI 宣布用户可通过 ChatGPT 移动端应用随时随地使用 Codex。该功能支持跨设备与远程环境实时监控、引导和批准编码任务。

    推荐理由:移动端接入让开发者能在手机上实时引导与批准代码生成,便于随时随地跟进远程开发任务。

5月12日周二
  1. Google DeepMind77

    Google DeepMind 推出科学研究多智能体系统 Co-Scientist

    Google DeepMind 推出基于 Gemini 构建的科研多智能体系统 Co-Scientist,用于在生命科学等领域自主生成、论证与迭代科研假说,相关成果已在 Nature 发表。

    推荐理由:系统利用多智能体辩论与天梯淘汰机制演进科学假说,读者可以了解大模型如何从文献检索走向严密的端到端科研推导。

5月5日周二
  1. OpenAI65

    OpenAI 推出 ChatGPT 广告新购买方式:上线测试版自助管理平台与 CPC 竞价

    OpenAI 拓展了 ChatGPT 广告投放能力,推出测试版自助广告管理平台(Ads Manager)、CPC 竞价机制以及增强型衡量工具。该广告系统在设计上强调保护用户隐私,并确保对话内容与广告展示保持相互独立。

    推荐理由:原文给出了广告投放从流程到计费形式的具体变化,读者可据此了解其商业化工具与对话隐私区隔的设计思路。

4月28日周二
4月22日周三
  1. OpenAI69

    OpenAI 在 ChatGPT 中推出工作区智能体

    OpenAI 在 ChatGPT 中推出工作区智能体(workspace agents),该智能体由 Codex 驱动并在云端运行。它旨在自动化复杂工作流,帮助团队在多种工具间安全扩展工作。

    推荐理由:展示了由 Codex 驱动的云端智能体形态,读者可以借此了解团队跨工具协同工作流的自动化方向。

4月16日周四
  1. OpenAI72

    OpenAI 更新 macOS 与 Windows 版 Codex 应用

    OpenAI 更新了面向 macOS 和 Windows 的 Codex 桌面应用程序,新增计算机使用(computer use)、应用内浏览、图像生成、记忆(memory)以及插件功能。该更新旨在进一步加速开发者的日常工作流。

    推荐理由:更新集中引入了计算机控制与应用内浏览等能力,展示了代码工具向通用桌面操作演进的具体方向。

  2. Hugging Face72

    Hugging Face 推出 transformers-to-mlx Skill 与测试套件,加速模型移植到 Apple MLX

    Hugging Face 推出基于 Claude Code 的 transformers-to-mlx 技能与独立测试套件,辅助开发者将 transformers 架构模型规范地移植到 Apple MLX 框架的 mlx-lm 库。

    推荐理由:它展示了如何将项目规范与独立验证流程封装为技能,在保证提交质量的同时降低开源模型跨框架迁移门槛。

4月15日周三
  1. Hugging Face75

    HCompany 推出浏览器 AI 扩展 HoloTab

    HCompany 推出基于其 Holo3 模型的 Chrome 扩展 HoloTab,支持在任意网站上通过提示词自动执行界面导航与表单填写等任务。扩展内置 Routines 功能,用户只需录制一次网页操作与语音讲解,即可生成自动化流程并支持随时重跑或定时执行。该扩展已在 Chrome 应用商店免费开放。

    推荐理由:原文展示了如何通过录制屏幕与语音解说生成自动化例程,使普通用户能直接在浏览器中复现复杂的跨网页任务。

4月9日周四
  1. Hugging Face74

    Sentence Transformers v5.4 发布:支持多模态嵌入与重排序模型

    Sentence Transformers 发布 v5.4 版本,正式支持通过统一 API 编码与比对文本、图像、音频和视频等多模态数据。新版本同时涵盖多模态嵌入(SentenceTransformer)与重排序(CrossEncoder)能力,原生适配 Qwen3-VL、Nemotron 等开源模型并支持混合输入。

    推荐理由:该更新统一了文本、图像与音视频的检索与重排序接口,便于开发者直接构建跨模态 RAG 管线。

3月31日周二
  1. Hugging Face76

    Hugging Face 正式发布后训练库 TRL v1.0

    Hugging Face 正式发布大语言模型后训练库 TRL v1.0,标志着该项目从实验性研究代码库正式演进为具备语义化版本稳定承诺的基础设施。该版本现已实现超过 75 种后训练方法,并采用将核心稳定层与实验层明确隔离的设计,以在限制过度抽象的同时应对快速演进的算法生态。后续团队将重点推进异步 GRPO 训练、MoE 分布式扩展以及面向智能体可读的结构化训练诊断信号。

    推荐理由:文章详细阐述了在后训练范式快速迭代下,框架如何通过双层稳定性契约与限制抽象设计平衡维护成本与灵活性。

3月29日周日
  1. Google DeepMind70

    Google DeepMind 提出 AI 时代鼠标指针交互,将 Gemini 引入 Chrome 与 Googlebook

    Google DeepMind 公布由 Gemini 驱动的 AI 指针(AI-enabled pointer)原型与交互原则,让用户通过直接指向屏幕内容并配合自然口语完成多模态任务。该系统能捕获光标周围的视觉与语义上下文,将屏幕像素转化为可操作实体,减少撰写复杂提示词的负担。相关能力已开始整合进 Chrome 浏览器,并将以 Magic Pointer 形式登陆 Googlebook。

    推荐理由:Google 将多模态光标理解引入桌面工作流,让交互从纯文本提示词转向结合手势指引与上下文的自然操作。

3月24日周二
  1. OpenAI68

    ChatGPT 推出视觉化商品发现与对比功能

    ChatGPT 推出基于 Agentic Commerce Protocol 的沉浸式视觉购物功能,支持商品发现、并排对比以及商家集成。用户可在对话中直接浏览商品并进行多维度对比。

    推荐理由:展现了智能体协议连接电商商家的具体方式,有助于理解生成式对话界面向交易与导购场景的演进。

3月10日周二
  1. OpenAI66

    ChatGPT 推出数学与科学交互式可视化学习功能

    ChatGPT 正式推出面向数学和科学领域的交互式可视化解释功能。该功能允许学生实时探索公式、变量与核心概念,提供更直观的动态理解方式。

    推荐理由:该功能为数理学习引入了可实时调整的交互式可视化,有助于学生直观理解公式推导与变量变化关系。

3月9日周一
  1. Hugging Face76

    Hugging Face 发布具身智能框架 LeRobot v0.5.0

    Hugging Face 正式发布开源机器人学习框架 LeRobot v0.5.0,新增宇树 Unitree G1 全身人形机器人支持与多款机械臂适配。新版本集成了 Pi0-FAST 自回归 VLA 策略与实时分块推理技术,并推出流式视频实时编码以消除数据采集等待。此外,更新还带来了用于直接从 Hub 加载仿真环境的 EnvHub,并接入了 NVIDIA IsaacLab-Arena。

    推荐理由:该版本将开源机器人框架扩展至人形机器人与自回归模型,大幅降低了硬件适配与仿真训练的接入门槛。

3月5日周四