跳到正文

#DeepMind

今日 0 条
9月30日周三
  1. Google DeepMind73

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质添加生物水印

    Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,可在 AI 设计的氨基酸序列与预测三维结构中嵌入隐形标记,并在物理合成的蛋白质中保持可检测性且不损害生物活性。湿实验证实加水印的蛋白质结合剂在结合亲和力与命中率上与未加水印版本一致,微调后的 AlphaFold 3 权重也能直接生成含签名坐标。团队已将该方法的研究论文、代码、模型权重及体外验证数据向社区开源。

    推荐理由:该技术首次将 AI 水印直接嵌入实体合成蛋白且保留原有生物功能,为基因合成筛查与生物安全验证提供了落地路径。

9月24日周四
  1. Google DeepMind67

    Google DeepMind 更新 Private AI Compute 架构,引入服务端安全记忆

    Google DeepMind 宣布对其 Private AI Compute 架构进行技术更新,为云端平台引入达到端侧隐私标准的服务端安全记忆能力。系统通过硬件安全飞地、端到端加密通道以及由个人设备独占的加密密钥隔离解密并即时加密上下文,确保包括 Google 在内的第三方均无法访问存储数据。

    推荐理由:原文阐述了硬件安全飞地与设备派生密钥的结合机制,为跨设备云端助手的隐私保护提供了落地参考。

9月16日周三
9月8日周二
  1. Google DeepMind78

    Google DeepMind 推出 AlphaGenome Atlas 基因组变异效应预测平台

    Google DeepMind 推出 AlphaGenome Atlas 平台,预先计算并提供了人类基因组中全部 90 亿个单核苷酸变异对分子生物学影响的预测数据。

    推荐理由:该平台预先计算了人类基因组所有单碱基突变的分子效应,为罕见病致病变异筛选和非编码区调控机制研究提供了可直接查询的参考图谱。

9月3日周四
9月2日周三
  1. Google DeepMind81

    Google DeepMind 推出 Gemini 智能体视频理解功能

    Google DeepMind 宣布在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中推出智能体视频理解功能,将视频分析 token 消耗减少最高 88%,成本降低最高 66%,准确率提升最高 7%。

    推荐理由:官方给出了按需动态检索视频片段与模态的机制和基准数据,读者可据此评估长视频任务中降低 token 成本的可行方案。

8月27日周四
  1. Google DeepMind60

    Google DeepMind 试点双盲 AI 评测机制

    Google DeepMind 联合多家机构试点双盲 AI 评测机制,利用密码学安全环境隔离外部测试集,防止模型提前接触题目造成基准污染。团队与新加坡 AI 安全研究所、OpenMined、AVERI 及 MLCommons 合作,在隐私保护环境中对 Gemini Flash Lite 模型进行保密基准测试。该方案旨在通过技术与密码学防护手段,确保前沿模型的能力和安全评测结果真实可信。

    推荐理由:DeepMind 通过密码学安全环境隔离测试数据与前沿模型,为防止基准污染和建立可信评测提供了技术落地参考。

  2. Google DeepMind74

    Google 推出语音转文字模型 Gemini 3.5 Transcribe

    Google 推出语音转文字模型 Gemini 3.5 Transcribe,能够直接将原始音频转换为排版工整、去除语气词和自纠错口语的结构化文本。模型提供用于亚秒级双向交互的实时流式接口与用于录音分析的处理接口,在流式与非流式场景下的平均词错误率分别为 4.0% 和 2.6%,支持超 85 种语言、自定义词库以及函数调用。

    推荐理由:该模型相比前代Chirp 3显著降低了词错误率与延迟,并通过实时流式接口与意图理解为语音智能体落地提供了更可用的方案。

8月21日周五
  1. Google DeepMind49

    从 Atari 到 EVE Online:基于 Google DeepMind 15 年游戏 AI 研究拓展前沿

    Google DeepMind 总结了其 15 年以游戏推动 AI 研发的历程,正携手 Fenris Creations 等开发团队探索通用游戏智能体与全新玩法原型。从早期的 DQN、AlphaGo 到由 Gemini 驱动的 SIMA 2,AI 已能通过屏幕画面和常规键鼠操作,在无需游戏代码权限的前提下实现跨 3D 游戏的类人交互与实时推理。

8月14日周五
  1. Google DeepMind83

    Google DeepMind 发布 Gemini 3.7 Flash

    Google DeepMind 正式推出 Gemini 3.7 Flash,主打编码与 AI 智能体工作流,在年底前以原版半价即每百万输入 tokens 0.75 美元、输出 tokens 3.75 美元提供服务。

    推荐理由:模型在软件工程和复杂文档基准上较前代有显著提升,且调用价格降低一半,有助于开发者降低高频智能体工作流的运行成本。

8月12日周三
  1. Google DeepMind69

    Google DeepMind 发布手语转文本模型 SL2T

    Google DeepMind 推出多语种手语转文本翻译模型 SL2T,并率先在 Pixel 11 上的 Gboard 和 Live Transcribe 中落地美式手语(ASL)听写功能。

    推荐理由:该模型跳过中间手语标注直接将骨骼位姿映射为文本,并兼顾端侧隐私与流式低延迟,为无障碍交互提供了软硬件结合的落地参考。

7月30日周四
  1. Google DeepMind62

    Google DeepMind 在 Flow Music 中推出音乐生成模型 Lyria 3.5

    Google DeepMind 宣布在 Google Flow Music 中上线最新音乐生成模型 Lyria 3.5,提升了音乐性、歌词质量与人声表现。该模型支持生成更自然复杂的旋律结构,并改善了歌词的提示词遵循度与发音表现力。此外,新版本还增强了创作控制功能,允许用户更便捷地调整生成音轨的节奏与时长。

    推荐理由:新版本在音乐生成中引入了节奏与时长的精细调节能力,有助于评估AI在结构化音乐编排中的实用性。

7月28日周二
  1. Google DeepMind76

    Google DeepMind 推出 Gemini Robotics 2 具身智能模型系列

    Google DeepMind 推出 Gemini Robotics 2 具身智能模型系列,包含视觉语言动作模型 VLA、具身推理模型 ER 2 以及轻量化的 On-Device 2。

    推荐理由:该系列将控制范围从桌面操作扩展至全身协调与多机协作,端侧模型仅需数小时即可适配新硬件,展示了具身模型跨形态落地的实际路径。

7月17日周五
  1. Google DeepMind63

    Google DeepMind 推出网络安全专用模型 Gemini 3.5 Flash Cyber

    Google DeepMind 推出轻量网络安全模型 Gemini 3.5 Flash Cyber,基于 3.5 Flash 微调,专用于快速发现、验证和修补代码漏洞。模型与安全智能体 CodeMender 结合,通过多次调用扩大代码路径搜索空间,在 V8 引擎测试中捕获 55 个独立确认问题,表现优于通用模型。考虑到双重用途安全风险,该模型初期仅向政府和受信任合作伙伴提供限量试用。

    推荐理由:原文展示了轻量安全模型在多轮并发调用下兼顾代码覆盖面与推理成本的实测数据,为工程团队设计自动化审计流水线提供了参考依据。

7月16日周四
7月13日周一
7月1日周三
6月25日周四
  1. Google DeepMind78

    Google DeepMind 在 Gemini 3.5 Flash 中原生集成计算机使用能力

    Google DeepMind 宣布在 Gemini 3.5 Flash 中原生内置计算机使用能力(Computer use),开发者可借此构建跨浏览器、移动端和桌面环境查看与操作的 AI 智能体。

    推荐理由:计算机操作能力从独立模型原生整合进主力 Flash 模型,开发者可通过 API 直接构建跨平台自动化智能体并调用企业安全防护系统。

6月17日周三
  1. Google DeepMind44

    Google DeepMind 携手英国政府开发 Gemini 规划原型,加速房屋建设审批

    Google DeepMind 联合英国政府及多方基于 Gemini 研发 AI 规划原型工具,旨在将房主规划申请的决策时间缩短 50%。该工具可自动整合数据、识别合规政策并起草评估报告初稿,全程由人工规划官员保留最终决策与审批权。在多地试点后,英国政府计划自 2027 年起向全国推广该工具,以助力 2029 年前新建 150 万套住房的目标。

6月16日周二
6月10日周三
  1. Google DeepMind43

    Google DeepMind 联合设立最高 $10M 多智能体 AI 安全研究资助

    Google DeepMind 联合 Schmidt Sciences、Cooperative AI Foundation 和 ARIA 设立最高 $10M 研究资助,面向全球征集多智能体 AI 安全研究方案。资助重点涵盖沙盒与测试平台、智能体网络科学、强化基础设施以及监督控制四大领域,旨在应对大规模智能体交互的群体安全风险。申请截止日期为 8 月 8 日,获选名单预计于秋季公布。

6月9日周二
  1. Google DeepMind82

    Google DeepMind 发布 Gemini 3.5 Live Translate 音频模型

    Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,支持 70 多种语言的近实时语音到语音互译。该模型通过流式处理连续生成翻译语音并保留原说话人的语调、语速与音高,全程仅滞后说话人数秒。

    推荐理由:模型通过流式生成将双向同传延迟缩短至数秒并保留原声语调,同时打通了开发者接口与办公终端的集成路径。

  2. Google DeepMind83

    Google DeepMind 推出 Gemma 4 12B:采用无编码器统一架构的多模态端侧模型

    Google DeepMind 正式推出多模态模型 Gemma 4 12B,采用无编码器的统一架构,使视觉与原生音频输入直接融入大语言模型主干进行处理。该模型在标准基准上的性能接近 26B MoE 模型,显存占用减半且仅需 16GB 内存即可在笔记本本地流畅运行。

    推荐理由:该模型舍弃了独立多模态编码器并将音频与视觉直接投影至大语言模型主干,为在消费级硬件上低显存部署多模态智能体提供了轻量架构参考。

  3. Google DeepMind43

    Google DeepMind 启动欧洲机器人加速器计划,入选 15 家初创企业

    Google DeepMind 推出欧洲机器人加速器计划(Google DeepMind Accelerator: Robotics),选拔了 15 家欧洲早期机器人初创公司。入选团队将获得为期 3 个月的密集技术指导,并可使用 Google 的 AI 技术栈及 Gemini 机器人模型。首批企业覆盖制造、医疗微型机器人及触觉电子皮肤等具身智能领域,旨在将前沿 AI 研究转化为落地应用。

5月22日周五
  1. Google DeepMind32

    Google DeepMind 在亚太地区推出加速器计划应对环境风险

    Google DeepMind 在亚太地区推出首期以“AI for the Planet”为主题的加速器计划 Google DeepMind Accelerator,旨在利用 AI 应对环境与气候风险。该为期 3 个月的项目面向亚太初创公司、研究团队和非营利组织,入选者将获得 Google AI 专家指导并整合前沿与科学 AI 模型。项目将以在新加坡举行的线下训练营开启,现已开放登记。

5月19日周二
  1. Google DeepMind56

    Google DeepMind 借助 Co-Scientist 加速逆转细胞衰老的基因线索筛选

    生物学团队借助 Google DeepMind 的 Co-Scientist 系统,加速逆转细胞衰老相关的基因线索筛选与海量实验数据分析。Co-Scientist 检索数万篇文献后提出了 20 多个候选基因因子,其中部分假说已获实验室验证并成功促使细胞恢复更年轻状态。此外,该系统将原本需要研究人员耗时多达 6 个月的筛选数据文献关联分析缩短至数天。

5月18日周一
  1. Google DeepMind70

    Google DeepMind 推出 Project Genie 街景模拟功能并面向 Google AI Ultra 用户开放

    Google DeepMind 宣布在世界模型实验原型 Project Genie 中上线 Street View 锚定功能,并逐步向全球 Google AI Ultra 订阅者开放。用户可选择美国境内地点并结合自定义风格与角色,生成基于真实街景图像的可交互虚拟环境。该能力由 Maps Imagery Grounding 技术支持,旨在为 AI 智能体与机器人提供更贴近现实的交互仿真环境。

    推荐理由:原文展示了通用世界模型 Genie 结合街景生成可交互真实场景的能力,有助于了解世界模型在环境仿真中的落地进展。

5月17日周日
  1. Google DeepMind66

    Google DeepMind 推出 Gemini for Science 科学研究 AI 工具集

    Google DeepMind 推出科学工具与实验集合 Gemini for Science,旨在通过通用智能体加速科研探索。套件在 Google Labs 推出三项实验工具,涵盖基于 Co-Scientist 的假设生成、基于 AlphaEvolve 与 ERA 的并行计算发现,以及基于 NotebookLM 的文献结构化洞察。

    推荐理由:文章详细梳理了多智能体与算法工具在假说生成、计算实验与文献分析中的具体机制,展现了AI介入科研全流程的工程路径。

5月16日周六
  1. Google DeepMind42

    Google DeepMind 与新加坡达成全新国家级 AI 合作伙伴关系

    Google DeepMind 宣布与新加坡政府深化国家级 AI 合作,推出多项前沿项目以支持公共部门转型、科学研究与教育发展。合作涵盖利用 AlphaFold 与基于 Gemma 的视障跑者助手等技术推进医疗科研,并向当地中小学至初级学院教师提供 Gemini for Education。该合作预计到 2040 年通过加速研发为新加坡创造 33 亿新元(25 亿美元)经济价值。

  2. Google DeepMind49

    利用 Co-Scientist 寻找新型传染病背后的分子开关

    剑桥大学 Clare Bryant 教授正利用 AI 系统 Co-Scientist 寻找病原体跨物种传播引发严重疾病的分子开关。通过分析研究提案与未公开实验数据,Co-Scientist 帮助团队将假说靶点从候选蛋白质精准缩小至特定氨基酸。这一原本通常需要 2 至 3 年实验的氨基酸筛选过程,借助该工具预计缩短至 6 个月完成。

  3. Google DeepMind45

    Co-Scientist 为衰老研究开辟新路径

    Calico Life Sciences 正利用 Co-Scientist 梳理复杂的衰老生物学文献,排除噪声并提炼出值得验证的科学假设。在整合应激反应(ISR)研究中,团队借助该工具提出了代谢调控 ISR 的新假设,并交互优化了实验方案设计。该实验已取得重要新发现,研究团队计划后续公开发表相关成果。

  4. Google DeepMind34

    Co-Scientist 助力整合生物学工具探索 ALS 研究新方法

    麻省理工学院与波士顿儿童医院的科学家借助 Co-Scientist 展开跨学科合作,共同探索肌萎缩侧索硬化症(ALS)的新疗法。Co-Scientist 快速梳理了庞杂文献,协助科研团队提炼可测试假说并按可行性进行排序,促成了组织建模与细胞表面 RNA 测绘工具的结合。目前双方正利用该系统加速寻找靶向 ALS 的新型 RNA 机制及潜在药物。

  5. Google DeepMind65

    斯坦福团队利用 DeepMind Co-Scientist 发现抗肝纤维化老药新用候选方案

    斯坦福大学医学院团队在《Advanced Science》发表研究,利用 Google DeepMind 的 Co-Scientist 系统从现有药物文献中筛选治疗肝纤维化的老药新用候选药。

    推荐理由:该研究给出了 AI 系统筛选老药新用并在活体人类细胞中实验验证的对比数据,为科研智能体在生物医药发现中的实际表现提供了直接参考。

  6. Google DeepMind67

    WeatherNext 如何协助美国国家飓风中心提前预测飓风梅丽莎登陆牙买加

    Google DeepMind 研发的 AI 气象模型 WeatherNext 协助美国国家飓风中心提前 5 天预测出飓风 Melissa 将快速增强并以 5 级强度登陆牙买加,为当地防灾疏散提供了关键预警窗口。

    推荐理由:展示了气象模型在风暴路径与强度协同预测中的实战表现,读者可了解集合预报机制在防灾减灾决策中的具体落地方式。

  7. Google DeepMind88

    Google DeepMind 发布 Gemini 3.5 Flash:主打智能体与编码能力并面向全球上线

    Google DeepMind 正式推出 Gemini 3.5 系列模型并首发 Gemini 3.5 Flash,主打复杂长流程智能体工作流与编码任务。该模型在 Terminal-Bench 2.1 达 76.2%、GDPval-AA 达 1656 Elo、MCP Atlas 达 83.6%,生成速度达其他前沿模型的 4 倍且成本大幅降低。

    推荐理由:该模型在保持高速低成本的同时大幅提升了智能体与编码基准得分,读者可据此评估长流程任务的自动化落地可行性。

5月12日周二
  1. Google DeepMind77

    Google DeepMind 推出科学研究多智能体系统 Co-Scientist

    Google DeepMind 推出基于 Gemini 构建的科研多智能体系统 Co-Scientist,用于在生命科学等领域自主生成、论证与迭代科研假说,相关成果已在 Nature 发表。

    推荐理由:系统利用多智能体辩论与天梯淘汰机制演进科学假说,读者可以了解大模型如何从文献检索走向严密的端到端科研推导。