跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 41–60 条 · 共 74 条
3月26日周四
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 3.1 Flash Live 实时语音模型

    Google DeepMind 正式推出实时语音模型 Gemini 3.1 Flash Live,提供更高精度、更低延迟以及更自然的语调理解与交互节奏。该模型在 ComplexFuncBench Audio 获得 90.8% 的成绩,开启思考模式后在 Audio MultiChallenge 达到 36.1%,且上下文对话跟踪时长提升至前代两倍。

    推荐理由:新模型在多步函数调用与长程推理上给出具体指标,同时强化了声调理解与多轮跟进能力,有助评估语音智能体的落地可用度。

  2. Google DeepMind63

    Google DeepMind 发布 AI 有害操纵评测工具包与实证研究

    Google DeepMind 发布了首个用于测量 AI 有害操纵的实证评估工具包,并公开了涵盖英美印三国 10,000 多名参与者的 9 项研究成果。该研究系统衡量了模型在金融和健康等高风险决策场景中的操纵倾向与实际有效性,开源了开展该类实验所需的全部材料。相关评估指标已纳入其前沿安全框架,用于测试 Gemini 3 Pro 等前沿大模型。

    推荐理由:该研究公开了测量 AI 有害操纵的实证工具包,为行业量化大模型在金融与健康等场景中的诱导风险提供了可复用的实验框架。

  3. Google DeepMind74

    Google DeepMind 发布音乐生成模型 Lyria 3 Pro

    Google DeepMind 推出音乐生成模型 Lyria 3 Pro,支持生成最长 3 分钟的音频,并能根据提示词精准编排前奏、主歌、副歌和过门等音乐结构。

    推荐理由:该版本将音乐生成时长扩展至三分针并支持结构化控制,同步落地到了云服务与视频创作工具中。

3月4日周三
  1. Google DeepMind79

    Google DeepMind 发布 Gemini 3.1 Flash-Lite

    Google DeepMind 推出面向大规模高吞吐工作流的模型 Gemini 3.1 Flash-Lite,已在 Google AI Studio 和 Vertex AI 开启预览。

    推荐理由:原文提供了具体的定价、推理速度提升倍数和基准测试分数,读者可以据此评估高并发任务中的成本与性能权衡。

2月27日周五
2月20日周五
  1. Google DeepMind80

    Google 发布 Gemini 3.1 Pro

    Google 推出新一代核心推理模型 Gemini 3.1 Pro,主打面向复杂任务的高级问题解决能力。在评估新逻辑模式解决能力的 ARC-AGI-2 基准中,该模型取得 77.1% 的验证得分,推理表现达到 3 Pro 的两倍以上。

    推荐理由:该模型在 ARC-AGI-2 基准上实现了相比前代翻倍的推理得分,读者可据此评估其在复杂逻辑与智能体工作流中的落地表现。

2月19日周四
  1. Google DeepMind78

    Gemini 上线音乐生成功能,搭载 Lyria 3 模型支持图文创作

    Google DeepMind 宣布在 Gemini 应用中上线音乐生成测试版,接入最新的音乐生成模型 Lyria 3。用户可通过文本、图片或视频提示词在数秒内生成 30 秒带歌词的音乐片段,并附带 Nano Banana 生成的封面图。所有音频均嵌入 SynthID 水印以供溯源验证,该功能正面向多语言 18 岁以上用户逐步推送,并同步接入 YouTube 的 Dream Track。

    推荐理由:Gemini 整合 Lyria 3 补齐了音频生成能力,用户可直接通过图文提示词快速生成带有防伪水印的短音乐片段。

2月13日周五
  1. Google DeepMind82

    Google DeepMind 发布 Gemini 3 Deep Think 升级版,面向科学与工程挑战

    Google DeepMind 发布 Gemini 3 Deep Think 深度思考模式的重大升级,强化其在科学研究与工程领域的复杂推理能力。基准测试中,该模式在无工具辅助下取得 Humanity's Last Exam 48.4% 和 ARC-AGI-2 84.6% 的成绩,并在国际数学、物理与化学奥林匹克竞赛中展现出金牌水准。

    推荐理由:该版本公布了在多项学科竞赛与基准测试中的具体得分,同时将高阶推理能力拓展到了工程应用与开发者接口。

2月10日周二
  1. Google DeepMind75

    Google DeepMind 利用 Gemini Deep Think 加速数学与科学发现

    Google DeepMind 发表两篇论文,展示 Gemini Deep Think 结合智能体工作流在数学、物理与计算机科学专业研究中的应用成果。团队基于该模式构建了具备自然语言验证和检索能力的数学研究智能体 Aletheia,已实现全自主生成算术几何论文并解答多项 Erdős 猜想。

    推荐理由:展示了推理模型结合自然语言验证与搜索的智能体架构,为将大模型引入前沿科学研究提供了可复用的人机协作路径。

1月30日周五
  1. Google DeepMind73

    Google DeepMind 推出 Project Genie:基于 Genie 3 的交互式虚拟世界创建原型

    Google DeepMind 宣布向美国年满 18 岁的 Google AI Ultra 订阅用户推出实验性原型 Web 应用 Project Genie,支持用户创建、探索和混剪可交互的虚拟世界。

    推荐理由:官方开放了基于世界模型生成交互式环境的原型工具,读者可以了解世界模型从离线生成走向实时可控探索的实际落地形态。

1月14日周三
12月17日周三
  1. Google DeepMind88

    Google DeepMind 发布 Gemini 3 Flash 模型

    Google DeepMind 正式推出主打速度与效率的 Gemini 3 Flash 模型,API 定价为每 1M 输入 token 0.50 美元、输出 3 美元。

    推荐理由:该模型在保持低延迟与低成本的同时具备较强推理能力,为高频交互和智能体工作流提供了更具性价比的基础模型选型。

12月13日周六
11月25日周二
  1. Google DeepMind74

    Google DeepMind 借助 AlphaFold 助力科学家解析心脏病关键蛋白 apoB100 结构

    密苏里大学研究团队结合冷冻电镜与 AlphaFold,成功绘制出构成坏胆固醇(LDL)分子骨架的关键蛋白质 apoB100 的原子级分辨率结构。该蛋白质因体积极大且与脂质复杂连接困扰学界 50 年,结构显示其呈现包裹 LDL 颗粒的笼状外壳与带状支撑结构。这一突破为理解坏胆固醇致病机理以及研发心血管疾病靶向治疗方案提供了关键结构依据。

    推荐理由:研究展示了AlphaFold结合冷冻电镜解析超大复杂蛋白的实践路径,为心血管疾病靶向研发提供了分子层面的结构依据。

11月24日周一
  1. Google DeepMind71

    Google DeepMind 支持美国能源部 Genesis 任务,向 17 所国家实验室开放科学 AI 工具

    Google DeepMind 宣布支持美国白宫与能源部(DOE)的 Genesis 任务,为全美 17 所国家实验室的研究人员提供前沿科学 AI 模型与智能体工具。

    推荐理由:原文给出了合作背景与工具开放时间表,读者可以据此了解前沿科学 AI 智能体如何深度接入国家级实验室科研体系。

11月20日周四
  1. Google DeepMind82

    Google DeepMind 发布图像生成模型 Nano Banana Pro(Gemini 3 Pro Image)

    Google DeepMind 正式推出基于 Gemini 3 Pro 构建的高保真图像生成与编辑模型 Nano Banana Pro(Gemini 3 Pro Image),目前已在 Google AI Studio 和 Vertex AI 向开发者开启付费预览。

    推荐理由:该模型重点强化了文字渲染与画面物理控制,并支持结合搜索检索生成事实性图表,展示了高保真图像生成的实用落地路径。

11月19日周三
  1. Google DeepMind90

    Google DeepMind 发布 Gemini 3 系列模型与智能体开发平台 Google Antigravity

    Google DeepMind 正式推出 Gemini 3 系列模型,核心模型 Gemini 3 Pro 重点提升了逻辑推理、多模态理解与智能体编程能力。该模型在 Terminal-Bench 2.0 取得 54.2% 得分,并在 WebDev Arena 达到 1487 Elo,同时官方配套推出了跨工作区协作的智能体开发平台 Google Antigravity。

    推荐理由:模型强化了终端控制与长上下文视频理解能力,配套智能体平台展示了从单点代码生成走向多智能体协作的落地路径。