ds4.1 死循环输出至 token 上限
用户在通过 clinepass 及 dsh 的 MAX 档调用 ds4.1 时遭遇异常,模型持续死循环输出“Enough. OK. Emitting. OK. Writing...”等内容直至触发 token 上限。该问题在换用官方 key 后恢复正常,未再出现死循环。据此推测,异常可能由部分第三方接口供应商采用的模型过度量化引起。
用户在通过 clinepass 及 dsh 的 MAX 档调用 ds4.1 时遭遇异常,模型持续死循环输出“Enough. OK. Emitting. OK. Writing...”等内容直至触发 token 上限。该问题在换用官方 key 后恢复正常,未再出现死循环。据此推测,异常可能由部分第三方接口供应商采用的模型过度量化引起。
用户在最新知识测试中发现 GPT 出现性能波动与降智迹象。测试显示,其一个账号在 high 思考强度下已无法答对相关测试题,需提升至 xhigh 强度才能答对,而另一个账号在 high 强度下仍能做对。与此同时,测试中两个账号的 web 模式均宣告失败。
Latent Space 专访 MIT 学者 Alex Zhang,深入探讨了递归语言模型(RLM)的核心机制与智能体运行架(Harness)设计。Alex 指出当前大模型多被原始系统包裹而未充分发挥能力,RLM 通过上下文卸载与基于代码的程序化子智能体调用,能实现跨任务的组合泛化并优化推理延迟。此外,访谈还探讨了 AI 生成 GPU 算子的验证瓶颈以及未来大模型演化为隐式多智能体集群的可能性。
Radical Numerics 联合创始人 Eric Nguyen 在访谈中指出,生物安全已成为类似网络安全的 AI 军备竞赛,防御端需要通过推进前沿生物模型来避免落后。
TypeSafe AI 创始人 Diogo Almeida 在 Latent Space 播客中解读了新发布的模型 Jev,阐述其面向软件调用而非聊天助手的定位。他认为当前依赖 RLHF 与 RLVR 的大模型存在校准与拒答问题,Jev 采用面向校准决策的强化学习(RLCD)及纯合成数据,旨在为软件自动化提供高可靠性、高性价比的系统 1 认知原语。
在 AlphaGo 击败世界围棋冠军十周年之际,Google DeepMind 梳理了其搜索与强化学习架构对现代 AI 及科学研究的深远影响。该技术路线已延伸至蛋白质结构预测工具 AlphaFold、数学推理系统 AlphaProof、算法探索工具 AlphaEvolve 以及 Gemini 的 Deep Think 模式。
Google 发布 2025 年度研究进展回顾,其前沿模型矩阵推出了 Gemini 2.5、Gemini 3 Pro 与 Gemini 3 Flash,其中 Gemini 3 Pro 登顶 LMArena 并在 MathArena Apex 取得 23.4% 的成绩。