DeepSeek V4 Pro正式版疑已灰度:思维链风格大变,联网搜索故障引猜测
DeepSeek V4 正式版疑似启动网页端灰度测试:思维链风格突变与搜索故障引发热议
近日,DeepSeek 网页端疑似正在进行新版底层模型的灰度测试,外界普遍推测这正是传闻已久的 DeepSeek V4 正式版(包含 V4 Flash 轻量版与 V4 Pro 专业版)。这一猜测在 7 月 22 日上午 DeepSeek 网页端联网搜索功能出现故障后进一步发酵。
核心变化:思维链(CoT)措辞风格显著不同
根据 Linux.do 社区及小红书用户流出的截图,本次灰度最直观的变化体现在模型生成“思维链”(Chain of Thought, CoT)的措辞风格上。多位社区用户实测确认“网页端上新了,API 还是旧的”,也有用户表示自己的账号仍为老模型,符合随机灰度的特征。
- 新版(疑似 V4 Pro 正式版):不再复述用户需求,开头直接进入分析。大量使用 “need”“will”“can” 等措辞,通篇不出现 “Let me…”。
- 旧版(预览版):特征是以 “The user wants me…” 开头复述用户需求。
尽管此前 DeepSeek 相关爆料多次出现“狼来了”的情况,但本次截图的思维链特征与 7 月中旬以来外媒和博主披露的灰测口径基本吻合,可信度相对较高。博主 AiBattle 此前给出的“验货口诀”正是看思维链开头措辞是否由 "I'm / I'll" 取代 "Let me",与今日网页端灰度截图的特征一致。
API 测试显示思维链措辞存在不稳定性
尽管网页端灰度特征明显,但对 DeepSeek 官方 API 的重复测试表明,思维链的措辞并不稳定,会随任务类型、系统提示词和采样结果变化:
- 面对简短身份问题:
- V4-Flash 在 5 次调用中出现 2 次“We need”、2 次“We are asked”和 1 次其他开头。
- V4-Pro 的 5 次调用全部以“We are asked”开头。
- 面对生成复杂网页游戏任务:
- 两款模型各调用 5 次,10 次结果全部回到“The user wants…”开头。
- 且全部在后文同时出现“Let me”和“I’ll”。
此外,灰度期间不宜用“知识截止日期”来验证版本。有用户发现网页端专家模式可能随机报出 2026 年 1 月至 6 月之间的某个截止时间,该问法已基本失效。
近期关键时间线梳理
将近几个月的动态串起来看,本次灰度并非突兀事件:
- 4 月 7 日–8 日:DeepSeek 深夜更新网页版与 App 对话界面,首次引入快速模式 / 专家模式分层设计。
- 7 月中旬:DeepSeek 官方邮件确认 V4 正式版计划于 7 月中旬上线,将分为 V4 Flash(轻量)与 V4 Pro(专业) 两个版本,并首次引入“峰谷计费”。
- 7 月 19 日–20 日:报道称 V4 正式版“可能最早明日发布,最迟不过这几天”,部分用户已拿到 GA 灰度权限。
- 7 月 22 日:网页端专家模式疑似开始更大范围随机灰度新版模型。同日上午联网搜索故障。
联网搜索故障与谣言
自 7 月 22 日上午起,不少用户发现 DeepSeek 网页端联网搜索无法使用,提示“由于技术原因,联网搜索暂不可用”。目前,官方未就故障原因作出说明。
互联网上流传着一张所谓“官方交流群”截图,声称 V4 延期源于机房遭入侵、核心代码和备份被删除。不过,联网搜索停摆与新模型灰度发生在同一天,社区自然联想到二者相关——例如后端模型切换、检索链路适配新模型或负载调整导致搜索模块临时下线。
总结
综合各方信息,DeepSeek V4 正式版(Flash / Pro)似乎已经临近发布。虽然 API 尚未全面更新,但网页端的灰度测试迹象表明,新版本已在小范围内进行测试。随着灰度范围的扩大,预计不久后将有更多用户体验到 V4 系列模型的新特性。