跳到正文

#推理

今日 1 条
今天10月3日周六
  1. LINUX DO 最新24

    ds4.1 死循环输出至 token 上限

    用户在通过 clinepass 及 dsh 的 MAX 档调用 ds4.1 时遭遇异常,模型持续死循环输出“Enough. OK. Emitting. OK. Writing...”等内容直至触发 token 上限。该问题在换用官方 key 后恢复正常,未再出现死循环。据此推测,异常可能由部分第三方接口供应商采用的模型过度量化引起。

10月2日周五
  1. LINUX DO 最新25

    GPT 降智或再创新高

    用户在最新知识测试中发现 GPT 出现性能波动与降智迹象。测试显示,其一个账号在 high 思考强度下已无法答对相关测试题,需提升至 xhigh 强度才能答对,而另一个账号在 high 强度下仍能做对。与此同时,测试中两个账号的 web 模式均宣告失败。

  2. Latent Space67

    Latent Space 对话 MIT Alex Zhang:探讨递归语言模型与智能体系统设计

    Latent Space 专访 MIT 学者 Alex Zhang,深入探讨了递归语言模型(RLM)的核心机制与智能体运行架(Harness)设计。Alex 指出当前大模型多被原始系统包裹而未充分发挥能力,RLM 通过上下文卸载与基于代码的程序化子智能体调用,能实现跨任务的组合泛化并优化推理延迟。此外,访谈还探讨了 AI 生成 GPU 算子的验证瓶颈以及未来大模型演化为隐式多智能体集群的可能性。

9月23日周三
9月22日周二
  1. Latent Space69

    Latent Space 对话 TypeSafe AI 创始人 Diogo Almeida:解读系统 1 模型 Jev 与 RLCD 技术路线

    TypeSafe AI 创始人 Diogo Almeida 在 Latent Space 播客中解读了新发布的模型 Jev,阐述其面向软件调用而非聊天助手的定位。他认为当前依赖 RLHF 与 RLVR 的大模型存在校准与拒答问题,Jev 采用面向校准决策的强化学习(RLCD)及纯合成数据,旨在为软件自动化提供高可靠性、高性价比的系统 1 认知原语。

3月9日周一
12月24日周三