跳到正文

#评测/基准

今日 2 条
今天10月3日周六
  1. LINUX DO 最新40

    国产 Agent 深度实测体验:Qoder、codebuddy、豆包工作与 zcode 对比

    Qoder 在长程复杂任务处理与执行安全性上表现最稳,但网络检索较弱且积分消耗快。豆包工作的网络资讯检索与办公交互体验最佳,代码任务完成度居第二梯队;codebuddy 复杂任务完成率较低且安全审批偏弱,zcode 则更适合自行接入模型。实际工作流推荐先由 6.1 sol 完成核心架构,再分配任务给国产 Agent 协作执行。

  2. LINUX DO 最新15

    这是 Qwen3.8-Flash?我路由到 Qwen4 了吧

    社区用户在 qoder 测试 Qwen3.8-Flash 时,因其在经典庭院提示词下的生成表现超出预期,发帖质疑请求是否被路由到了 Qwen4。其他用户回复证实该输出确实来自 Qwen3.8-Flash 本身,并表示该模型达到此水平属于正常表现。