有大有小 · 企微 AI · 工程进展

今天把话术优化到哪了,接下来怎么走

大白话版,写给团队看:今天用真实对话逐句压测,发现了哪些毛病、已经修好了什么、后面怎么才能越做越好。

日期:2026-07-10压测样本:3 段真实对话 · 132 轮今日上线改动:5 个(已全部部署)
01

今天在解决什么

一句话:让企微 AI 的话术,在长对话里也稳得住、不穿帮,做到跟金牌销售一样能打。核心异议(砍价、板材、增项、样板房)它已经能打平甚至赢金牌;今天专门去啃「聊得越久越容易出毛病」这个硬骨头。

02

发现了哪些毛病

做法很实在:把三段真人对话里客户说的每一句,原样喂给现在线上的 AI 重跑一遍(132 轮),看它哪里会翻车。翻出三类:

根子在哪:企微这套 AI 用的是 GLM 模型,对话一长(几十轮堆在一起)就不稳——不是话术设计不好,是模型在超长上下文里“脑子会乱”。所以光改话术/提示词压不住,得从机制上治。
03

今天已经修好的(5 个改动,全部上线)

每一条都对着上面的毛病来,改完都跑了自动化测试、合并部署到线上了。

✓ 5 个改动今天已全部合并到主干、部署上线
04

接下来怎么才能越做越好

你问的「靠代码?提示词?还是投喂更多真人案例?」——三条腿都要,但性价比排序很清楚:

本页为内部工程进展记录 · 大白话版
对外给客户看的话术对比报告是另一份(企业微信现有对话能力分析)