有大有小 · 企业微信 AI · 部署纪要

今日部署:企微 AI 换模型 + 对话记忆增强

大白话版,写给团队看:今天把企微 AI 的底层模型换了、给它加了"对话记忆",为什么换、怎么测出来的、记忆增强到底做了啥——一页说清。

日期:2026-07-10上线改动:8 个 PR(全部部署)压测:8 模型 × 28 探针 × 3 采样 · 双裁判
01

先说结论:两件大事

02

发现的问题(为什么要动)

用真实对话逐句压测(132 轮)+ 反复复跑,把企微 AI 在长对话里的毛病都翻了出来:

03

对话记忆增强做了什么

根因是"对话一长、历史全塞给模型 → 模型被撑晕"。记忆增强就是把这条从根上治掉。

04

换模型:怎么测的、为什么最终选 qwen

企微原来用 GLM-4.6(2026-07-02 一次严谨评测选出来的)。这次同规格复评(8 模型 × 28 探针[含超长尾] × 3 采样 × 双裁判 grok-4.3+deepseek-v3.2,含新测的 kimi-k2.6)重新比了一遍。

05

部署 + 回滚

本页为内部部署纪要 · 大白话版 · 2026-07-10
模型排名为线上同款 chatReply 实测输出、双裁判匿名打分聚合