← 上一章☰ 目录下一章 →
第二十四章
一千八百字的说明书
卷三 · 原来这门生意是这样的 | 挂载真题 4 道(新D6、F6、D7、J4)| 织法 A · 朴素观察

不知道从什么时候开始,我产品的开场白 Prompt 写了一千八百多个字。

不是一天写出来的。是三个月里一条一条加起来的——今天加一条规则「如果用户是应届生就强调学习能力」,明天加一条「如果公司是创业公司就突出适应力」,后天加一条「不要用过于正式的语气」。每一条单独看都有道理——都是某个 badcase 的修复。但三个月后回头看——它变成了一篇没人读得完的说明书。

问题是什么时候暴露的?不是我自己发现的——是我的用户帮我发现的。

有一天林哥发了一条消息给我:「你那个开场白最近是不是变了?感觉没之前好了。」我心里一紧——我没改过模型啊。我查了一下——没改。又看了一下调用日志——也没发现异常。最后我把当前 Prompt 调出来读了一遍——才发现问题出在哪。

一千八百字。里面塞了大概二十多条规则。有些规则是互相矛盾的。第三条说「语气要正式、专业」——第十九条说「可以用轻松的语气开头的」——两条规则之间隔了两个月加的,加上去的时候谁也没记得前面已经写过什么。模型读到第三条的时候按正式语气写、读到第十九条的时候又收回来试图轻松——结果是开场白写得既不正式也不轻松——像一个不知道该怎么跟人说话的人硬挤出来的话。

而且有些规则已经过时了。第八条「不要用波浪号」——是三个月前加的,因为那时候模型特别喜欢在结尾加波浪号。但现在模型已经不会加波浪号了——那条规则还是躺在那里没删。但它仍然在吃掉我的输入 Token——每条开场白多花我大概几十个 Token,一个月加起来也是一笔钱。

上下文瘦身——这个词是我后来从小周那里学到的。他说:「你每个月花几百块喂给模型看的规则里,大概有一半模型其实已经会了。那些规则不是在帮模型——是在浪费你的钱。」

一、瘦身过程:从一千八百字到六百字

我花了一个周末做了一次 Prompt 瘦身。方法很简单——把每一条规则单独拎出来,问三个问题:这条规则有没有对应的 badcase?现在这个 badcase 还能复现吗?模型当前版本还会犯这个错吗?

答案让我很惊讶。

二十三条规则里,有八条的 badcase 已经无法复现了——模型升级之后自动修好了。有五条跟其他规则矛盾——删掉一条之后另一条就能正常工作。有三条是重复的——「不要用过于正式的语气」「可以适当口语化」「避免公文感」其实在说同一件事。只有七条是真正有效的。

我把二十三条删成了七条。一千八百字瘦身到六百字。

瘦身后的第一周我特别紧张——一直在等有人跟我说开场白变差了。但一周过去没人说。林哥没发消息——他大概自己都忘了前两天说过「感觉没之前好了」这件事。我跑了一轮回归测试——回复率没有变化。

但成本有明显变化。每个月开场白生成的输入 Token 减少了大概百分之四十——因为我喂给模型的 Prompt 从一千八百字变成了六百字。加上输出长度控制——每个月省了大概二三十块。

更重要的是——我建立了一个规则:每次加新规则之前必须先删一条旧规则。这样 Prompt 不会无限制地膨胀下去。而且每三个月做一次全面审查——看看哪些规则已经被模型版本更新覆盖了。

· · ·

二、阿 May 说「你那个说明书跟我们的设计说明一样」

「你有没有写过那种你自己都看不下去的设计说明?」我问阿 May。

「写过——四十页的。项目经理拿给甲方,甲方看了一眼目录就放下了。施工队来了之后直接翻到苗木表——前面那三十多页没人看。」

「然后呢?」

「然后我们学会了一件事——设计说明不是写越多越好。控制在三到五页以内。把最重要的东西放前面——设计理念、规范依据、关键参数。后面那些每棵树怎么种、每个节点什么做法——标准做法不出详图。真正需要单独写的只有特殊情况——场地高差超过五米的、有古树要保护的、跟红线有冲突的。」

「那施工队不看前面怎么办?」

「他们也学会了——前面那几页他们最近也开始翻了。因为发现我们只写最重要的东西在说明里——不看就会漏掉关键信息。你把废话删完了——剩下的话就有人看了。」

Prompt 瘦身的道理一模一样:你把废话删完了——模型才能看到重点。

三、技术细节:我的瘦身方法

我总结了一套 Prompt 瘦身的方法——分成四步:

第一步:可复现性测试。每一条规则拎出来单独测试——没有这条规则模型会犯错吗?没有这条规则加这条规则输出一样吗?如果一样——这条规则已经死了,删。不一样——保留继续测。

第二步:矛盾检测。把规则两两放在一起看——有没有互相矛盾的?「语气要正式」和「可以用轻松语气开头」就是矛盾的。矛盾规则优先删加得晚的那条——说明后面这条是补丁、前面的才是基础。

第三步:重复合并。三到四条说同一件事的——合并成一条明确规则。比如「不要用过于正式的语气」「可以适当口语化」「避免公文感」合并成「语气接近真人聊天、不要像公文」。写清楚比写多条更靠谱——因为多条规则模型不知道优先级。

第四步:版本锚定。标注每条规则是哪个月加的。如果模型已经跨了两个大版本——这条规则基本可以删了试一下。模型变聪明了——写在旧版本上的规则在新版本上可能已经天然成立。

瘦身完之后我定了一个流程:每次加新规则之前先在回归集上跑一遍——确认没有这条规则的 baseline 输出是什么样的。加了之后再跑一遍——确认新增规则确实改变了输出。改变符合预期——保留。改变不符合预期或者没有改变——不加。

四、坑在哪

坑一:把每一条规则都当成永恒的。加规则的时候觉得这条永远有用——但模型在升级、用户习惯在变、场景在扩展。三个月前的规则三个月后可能就是废话。规则是有有效期的——过期就该删。

坑二:不敢删规则因为「万一会用到」。「先留着也没坏处」——有坏处。每一条规则都在消耗输入 Token。一百个字的规则一次调用多花几厘钱——一个月几千次调用就是几十块钱。留着不用的规则不是「无害保存」——是「持续缴费」。

坑三:新规则覆盖旧规则但不删旧规则。第十九条「可以用轻松语气开头」覆盖了第三条「语气要正式」——但两条都留着。模型读到矛盾指令时表现会不稳定——有时候正式有时候轻松。删规则比加规则更能让模型表现稳定。

坑四:只加不减的膨胀。任何系统不加约束地增长都会趋向于混乱和冗余——Prompt 也是。我后来定了一条死规矩:加一条新规则之前必须删至少一条旧规则。总量控制倒逼精简。

· · ·

五、面试实战 · 当面试官问你 Prompt 优化

第二场面试在一家头部 AI 公司。面试官问了一个让我觉得「这道题我刚好会」的问题。

真题 · 新D6(上下文窗口 · ★★★)「你怎么管理和优化你的 Prompt?上下文窗口不够用怎么办?」

(破题)这道题表面在问 Prompt 管理——实际在问两个事:你有没有遇到过真的塞不下的场景?以及你有没有系统性的优化方法。『不够用』不是加窗口——是减内容。

(翻存货)第一样是我的一千八百字到六百字的瘦身经验。用它证明你有系统化的 Prompt 管理方法。
第二样是我的分层策略——什么信息必须放 Prompt、什么信息用 RAG 塞。用它展示你对『塞不下』这个问题的解决方案。

口播稿 · 约 100 秒 「我先说我犯过的错——我的开场白 Prompt 从几百字长到了一千八百字,出场质量反而下降了。

我做了三件事:
第一,瘦身。每条规则单独做可复现性测试——不能复现 badcase 的规则删掉。二十三条删到七条,一千八百字到六百字。输入 Token 省了约四成,质量没降。
第二,分层。不是所有信息都塞 Prompt——知识性信息放 RAG、格式要求放 Prompt、风格示例放 few-shot。Prompt 只保留『这个任务应该怎么做』的核心指令。『这个岗位的信息』这种动态内容走 RAG——不进 Prompt。
第三,总量控制。加一条新规则之前必须先删至少一条旧规则——让 Prompt 总量从自由膨胀变成总量控制。

如果上下文真的不够用——我会先判断『不够用的是指令信息还是参考信息』。指令信息不够——压缩指令、减少规则。参考信息不够——用 RAG 查、用检索代替硬塞。收口:不够用不是加窗口——是减内容。」

(追问一)「你瘦身后质量没降——那如果瘦身后降了你怎么办?」
——我答:瘦身不是一次做完的。我的做法是先删最确定没用的那几条——跑回归集确认质量没降——再删下一批。分批次瘦身、每批都验证。如果某一批质量降了——回退到上一批,找出是哪条规则被误删了。保留它,继续删下一批。

(追问二)「你有没有试过用大上下文模型来解决问题?」
——我答:试过——大上下文模型的确能塞更多内容,但有两个问题。第一,成本更高——输入 Token 翻倍成本也翻倍。第二,内容多了模型反而不容易找到重点——一千八百字的 Prompt 用大模型跑结果也没变好。所以我的判断是:先瘦身再考虑换模型——瘦不了身说明你的 Prompt 设计有问题,不是模型不够大。

答复提案 · 「Prompt 管理」 v1 → v2 v1(废弃):「我们通过压缩 Prompt 来管理上下文。」——只说结果不说方法。

v2(定稿)
· 开口白:「我先说我犯过的错——开场白 Prompt 从几百字长到一千八百字,质量反而下降了。」——用犯错开头,比用方法论开头更有记忆点。
· 结构:犯错(一千八百字)→ 瘦身法(可复现性测试+矛盾检测+合并+版本锚定)→ 分层策略(指令走 Prompt、知识走 RAG)→ 总量控制。
· 30 秒版:「一千八百字的 Prompt 质量反而下降了——因为规则互相矛盾、模型看不懂优先级。做了三件事:瘦身——二十三条规则删成七条、一千八百字到六百字、Token 省四成、质量没降。分层——指令走 Prompt、知识走 RAG。总量控制——加一条之前先删一条。不够用不是加窗口——是减内容。」
· 锚点:一个数字——一千八百字瘦到六百字。一个原则——加一条先删一条。

· · ·

六、速查卡

新D6(上下文窗口)「你怎么管理和优化 Prompt?」

他还会这么问:侧问——「你 Prompt 里有多少条规则?」——他没问你怎么管理但数字会暴露你有没有管理。
他在考什么:面试官想看的不是你会写 Prompt——是你写过一段时间之后还能不能把 Prompt 管好。写 Prompt 的能力是入门级的——管 Prompt 的能力才是进阶级的。
结论句:写 Prompt 是加法——管 Prompt 是加法之后还要做减法。
三点口播稿:「我管 Prompt 有三条原则。
第一,每条规则都有身份证。每加一条规则之前先登记——哪年哪月加的、对应的 badcase 是什么、验证方法是什么。没有身份证的规则不能存在。三个月后回头看——那些 badcase 还能不能复现?不能复现的规则删掉。规则不是永恒真理——是有有效期的 bug 修复。
第二,总量控制。不论功能多复杂——Prompt 核心指令不超过一定字数。超过之前先压缩。不压缩就加规则的结果是——新规则盖住旧规则、旧规则干扰新规则、模型谁都不听。我设了一个上限——开场白 Prompt 不超过八百字。超过了就先删再改。上限迫使你做优先级排序——重要的留、不重要的砍。
第三,冷热分离。不变的、所有场景通用的指令——放 Prompt(热)。变化的、每个场景不同的信息——走 RAG 检索(冷)。永远不变的用户身份信息——写进系统 Prompt。这种冷热分离让我的 Prompt 结构清晰——不管是人读还是模型读都知道重点在哪。一个 Prompt 里如果同时有『永远不变』和『每次不同』的内容——说明你还没做冷热分离。
收口:总结一下——每半年做一次全面审查、每次加新规则之前做一个可复现性测试、每次加一条之前必须删一条。如果做到这三条——你的 Prompt 不会写着写着就失控了。」
数据锚点:一条法规——每半年审查一次。一条测试方法——可复现性测试。一个控制机制——加一条删一条。万能开头:「管 Prompt 有三条原则。」
30 秒版:「三条。第一——每条规则都有身份证、有对应的 badcase、有验证方法。半年后 badcase 不能复现就删。第二——总量控制。开场白 Prompt 不超过八百字——超过了必须先删再改。上限迫使你做优先级排序。第三——冷热分离。不变的放 Prompt 变化的走 RAG。一个 Prompt 里如果同时有永远不变和每次不同的内容——说明没做冷热分离。总结:每半年审查一次、加新规则前先验证、加一条之前先删一条。」

新F6(成本优化)「Prompt 瘦身之后成本降了多少?」

他还会这么问:追问——「瘦身有没有影响输出质量?」——他在想确认你是不是只是为了省钱而牺牲了质量。
他在考什么:面试官想看你能不能把一个优化动作的效果量化到具体的数字。Prompt 瘦身是一个特别好的例子——因为它同时涉及成本和质量两个维度。
结论句:瘦身的效果不是只看省了多少钱——是看省了多少钱的同时质量有没有变化。
三点口播稿:「具体数据是这样的——瘦身前后的对比。
成本维度:瘦身前 Prompt 一千八百字——每次调用输入 Token 约两千二。瘦身后六百字——每次调用约九百。降幅约百分之五十九。按每个月开场白生成调用量来算——月省约二十到三十块。省的钱不算多——但这是一个永久性的节省。一次瘦身、持续省钱。
质量维度:瘦身前后各跑了一百条回归测试——盲评打分。瘦身前平均分 12.8,瘦身后 12.9。没有统计学上的显著差异——质量没降。质量没降的原因是:删掉的都是模型已经会了不再需要的规则——删的是废话,不是核心指令。
额外收益:瘦身之后模型输出的一致性提升了——因为规则少了、互相矛盾的场景少了。输出风格更加稳定。省了钱、质量没降、输出更稳定——三个方向都是正的。
收口:所以 Prompt 瘦身是我做过的性价比最高的优化——投入是一个周末的时间、收益是每个月持续的省钱加更稳定的输出质量。我推荐每个有 Prompt 的产品都至少做一次全面的瘦身审查。」
数据锚点:两个数字——一千八百字到六百字、省五十九个百分点的 Token。一个结论——质量没降但输出更稳定。万能开头:「具体数据——瘦身前一千八百字、瘦身后六百字。」
30 秒版:「瘦身前一千八百字、瘦身后六百字——输入 Token 省了约五成九。按月调用量算大概省二十到三十块。质量没降——回归测试盲评 12.8 对 12.9。反而输出更稳定了——因为删掉的都是互相矛盾的规则。一次瘦身持续省钱。性价比最高的优化——没有之一。」

新D7(版本管理)「你怎么管理 Prompt 的版本?」

他还会这么问:追问——「你每次改 Prompt 之后怎么确认效果?」——他想看的不只是你管了——是你会不会验证改动。
他在考什么:面试官想知道你对待 Prompt 的态度——是像代码一样管还是随手写写就上线。Prompt 就是你的代码——只不过它运行在模型上而不是服务器上。是代码就应该有版本管理。
结论句:Prompt 版本管理的核心不是工具——是每次改之前你知道你改了哪个版本、改完你知道是变好了还是变差了。
三点口播稿:「我是从一场事故里学会管 Prompt 版本的——第十四章那件事。
第一,每一个 Prompt 版本我都用文档管理。每个版本有一个文档——包含三部分:这个版本的目标是什么(比如『减少开场白的模板感』)、改了什么(具体改了哪条规则或者加了什么示例)、怎么验证(在回归集上预期提升什么指标)。每个版本号按日期加序号——比如开场白 v2.4-20260115。不是用 Git——还没有到那个规模。用文档的原因很简单——三个月后回头看,你还能说清楚当时为什么改。没有改版说明的版本改动=没有改动。
第二,每个版本上线前跑回归集。同一批测试用例、同一个评分标准——新旧版本各跑一次。分数没有下降才能上线。分数下降了——回退。分数上升了——记录原因备用。回归集是 Prompt 版本管理的门禁——它拦住你做坏了的改动。
第三,Prompt 改了的通知范围。如果改的不是修复 bug 是功能调整——我会告诉团队(如果我有团队的话)。改的是影响输出的核心 Prompt——用户可能感知到变化。用户没感知到——说明改的不重要。不能只改不通知——因为你改了之后别人发现输出变了会以为是模型出了问题。
收口:所以我的 Prompt 版本管理没有用很复杂的工具——就是一个文件夹、每版一个文档、每条改动有原因。但它的核心作用不是管理——是让我每次改的时候知道自己在改什么、改完之后知道改对了还是改错了。管 Prompt 跟管代码一样——不是因为它高级——是因为不改不知道改了之后会发生什么。」
数据锚点:一套命名规则——v2.4-20260115。一个验证方法——回归集对比。一个原则——改版说明要有。万能开头:「从一场事故里学会的——第十四章那次。」
30 秒版:「三个做法。第一——每版 Prompt 一个文档:目标、改动、验证方法。版本号按日期编——三个月后还能说清为什么改。没有改版说明的改动不是改动。第二——每版上线前跑回归集。分数没降才上——降了回退。回归集是门禁。第三——改核心 Prompt 要通知——用户可能感知到变化。一个文件夹、每版一个文档、每条改动有原因。不是因为它高级——是因为不改不知道改了之后会发生什么。」

新J4(成本思维)「你做过性价比最高的优化是什么?」

他还会这么问:侧问——「你怎么定义性价比?」——他在测你有没有一个量化的标准。
他在考什么:面试官想知道你投入产出的判断力——不是你知道哪些优化有用,是你知道哪些优化值得做。性价比最高的优化不是你省了最多钱的——是你花最少精力得到了最大持续收益的。
结论句:性价比最高的优化有一个共同特征——投入一次、持续收益、用户无感知。
三点口播稿:「我做过性价比最高的优化是 Prompt 瘦身——没有之一。
投入:一个周末。周六早上开始——把开场白 Prompt 全部读一遍、每条规则单独拎出来做可复现性测试、合并重复的、删掉过时的。周日下午结束——前后不到两天。投入几乎为零——因为不需要写代码、不需要调模型、不需要等审批。
收益持续且自动。一次瘦身之后——每次调用都自动省了约六成的输入 Token。不是今天省、明天不省了——是一直在省。按月算大概二十到三十块。不多——但它是躺着收钱的优化。做过一次之后不用再管——每个月自动省钱。
用户完全无感知。输出质量没降——回归测试验证了。输出风格还变稳定了——因为删掉了互相矛盾的规则。用户没有来投诉、没有说开场白变差了、没有问发生了什么——这就是最好的优化:你做了但是用户不知道你做了。
收口:怎么定义性价比?我的定义是——投入产出比加上持续性的乘积。Prompt 瘦身的投入是一个周末——产出是每个月省二十到三十块而且一直持续。所以它的性价比远超其他优化——那些优化要么投入大(改架构)、要么不是持续的(缓存只能省一部分)。一个周末换每个月的持续节省——这是我做过最值的事。」
数据锚点:一个时间——一个周末。一个收益——月省二十到三十块持续。一个判断——用户无感知。万能开头:「性价比最高的优化是 Prompt 瘦身——没有之一。」
30 秒版:「Prompt 瘦身——没有之一。投入一个周末——把开场白 Prompt 一千八百字瘦到六百字。收益:月省二十到三十块、持续自动。用户无感知——输出质量没降反而更稳定了。一个周末换每个月持续省钱——投入产出比和持续性的乘积最高。比改架构省时间、比加缓存更持续、比换模型更便宜。」

· · ·

七、这一章我真正学会的那一招

一千八百字的说明书。回头看我加每一条规则的时候——都觉得这条是必要的。但没有一条规则是永久有效的——因为模型在变、场景在变、用户在变。我以前的思考方式是「加规则解决问题」——现在多了一步判断:「这个问题还会存在多久?」

三个月前的规则可能已经死了——只是没人给它办葬礼。而不删掉它,它就一直在吃我的输入 Token。

所有文字都值得反复删——不仅是 Prompt。产品文案、用户引导、错误提示、面试回答——写的时候觉得每句都有用,回头看一半是废话。删完剩下的才是真正重要的东西。

「加规则之前先问一句:这条规则的有效期是多久?到期了谁来删?」

那天晚上我在新本子上又加了一行——在 327.40 下面:

「每搜索省三块。每匹配省六毛。每生成省一毛。模型分级省一百。Prompt 瘦身省二十五。——写每一条规则之前先问:它的有效期是多久?」

【掉落】一千八百字的 Prompt—每个字都在花钱。瘦身到六百字之后——成本降了、输出更稳了、用户完全没发现。所有文字都值得反复删——不只是 Prompt,面试回答也一样。

补遗 · 上下文与规则(6 题)

OCR 混合场景

①( 大白话定义:

先打个比方:一个员工,让他既读手写便条(文(档(),又认街头霓虹招牌(街(景(),还看电脑截图里的按钮文字(网页截图)——三样东西长得完全不一样——手写便条横平竖直,招牌又斜又花还带灯,截图字小色多——还让他认「弯成弧形的店名」不规则文本)——这活儿难不难?OCR(光学字符识别:把图片里的文字变成可编辑文本的技术)干的就是这活——把三样场景的文字都认出来,把歪的、斜(的(、弯(的(、艺术字(不规则文本)也认出来——一句话判断:OCR 的难题是「场景多、文本不规则」——解法是「先分流、再矫正、后识别」——场景分得清,歪字认得准。

三十秒电梯版:OCR 场景与不规则文本怎么答?先讲问题——三个场景混在一起:街(景(自然场景文字:背景杂、会旋转倾斜)、文(档(规整横排、黑白高对比)、网页截图(U(I(用户界面)字(体(、小字号带颜色)——混合会影响:领域差异大,单一模型要拟合多个分布,可能互相干扰——再讲解法——三(层(:分类分流(图像分类器先判场景,路由到专用模型);检测加矫正(任意形状检测框住弯曲文本,空间变换网络矫正成水平);识别加后处理(序列识别加语言模型修正)——再讲产品——按场景配模型、按场景采数据、指标分场景统计——收(口(:先分流、再矫正、后识别——场景分得清,歪字认得准。

②( 为什么学:

第(一(,OCR 是( A(I( 应用的高频落地场景——证件识别、票据识别、截图提取、街景标注——面试常考。

第(二(,「场景混合」和(「不规则文本」是( OCR 的两大真问题——答出来就是实战经验——不是背概念。

第(三(,场景分流(先分类再识别)的思路是通用的——不(止( OCR,图像多场景任务都用——会一题通一类。

第(四(,「检(测(、矫(正(、识(别(」三层管线是 OCR 的标准架构——讲清管线,技术理解立现。

第(五(,一通百通——「先分流、再矫正、后识别」适用于一切复杂输入处理——把这条记熟,OCR 类面试题都能接住。

③( 原理拆解(8( 层():

第一层:三个场景的文字差异——街(景(自然场景文字):背景复杂(招(牌(、霓(虹(、墙(面()、字体多样(艺术字、手写体)、可能旋转倾斜、光照不均;文(档(:横排规整、黑白高对比、字体统一;网页截图:U(I( 字体清晰、字号小、彩色背景加白色文字常见——三者的特征分布差异很大。打个比方:三个菜市场的招牌——菜市场的霓虹灯牌(街(景():花(哨(、斜(挂(、还(闪(;超市价签(文(档():白纸黑字整整齐齐;手机屏幕上的按钮(网页截图):字(小(、彩(色(、圆(角(——认招牌的人(OCR 模(型()要同时认识三种「字(」,每种长得都不一样——认识一种不代表认识另一种。

第二层:混合训练的影响——把三种场景数据放一起训练一个模型——好(处(:一个模型吃遍三种场景;风(险(:领域差异大,模型要同时拟合多个分布——街景的旋转字符可能让模型对文档字也「犯(晕(」,文档的规整字符可能让模型在街景上漏检——领域漂移(模型在 A( 场景学到的偏差带到 B( 场(景()是混合训练的主要风险——但数据充足、架构够强时也能泛化,未必互相伤害。打个比方:一个员工被要求同时处理三份完全不同格式的报表——表格格式不同(场景分布不同),他可能把 A( 报表的栏位习惯带到 B( 报(表(领域漂移)——但培训充分(数据充足)、方法到位(架构好),他也能都干好——关键是培训资料(训练数据)要覆盖三种格式且均衡。

第三层:分类分流——与其让一个模型硬扛三种场景,不如先分流——图像分类器先判断「这是街景、文档还是截图」,再把图送到对应场景的专用模型——专用模型各练各的,互不干扰——分类器分错是误差源头,所以分类器本身要准——分流是「分而治之」,比(「一肩挑」更(稳(。打个比方:医院分诊台——不把内科外科皮肤科的病人都塞给一个医生(一个通用模型),而是分诊台(分类器)先分科(判场景),再送对应科室(专用模型)——分诊台分错科,再好的医生也白搭——分诊准(分类准)是整个流程的地基。

第四层:不规则文本的形态——不规则文本指「不横平竖直」的文字:旋(转(倾斜 3(0( 度的招牌)、垂(直(竖排店招)、弯(曲(弧形招牌)、透(视(路边大字近大远小)、艺术字(字体变形、加纹理)——规则文本检测器用矩形框,不规则文本框不住——检测框的形状决定能不能「框(对(」。打个比方:给不同形状的东西配相框——普通照片(规则文本)用矩形框就行;全景照(弯曲文本)矩形框装不下,要异形框(多边形框)——相框形状(检测框形状)配错了,照(片(文本)就歪着摆,看不清——先配对框,再谈看清。

第五层:检测层解法——不规则文本的检测要从「矩形框」升级到「任意形状框」——四边形框(四个点)变多边形框(多个点,贴合弯曲走向)——检测模型输出文本区域的精细轮廓(弯曲文本检测的代表思路)——检测框贴合了,才轮到识别——检测是识别的前提,检测框错了,识别再好也白费。打个比方:裁缝量体裁衣——量(体(检测)要量出身体的真实曲线(文本走向)——只量肩宽腰围(矩形框)做不出曲线裁剪(识别弯曲文本)——量体多取几个点(多边形框),衣(服(识别结果)才合身——测(量(检测)是第一步,也是最重要的一步。

第六层:矫正层解法——检测到不规则文本后,先(「扶(正(」再识别——空间变换网络(用网络学出一个变换,把弯曲旋转的文本拉伸成水平规整的图)——矫正后的图给识别器,识别难度大降——矫正让「难识别的输入」变(「好识别的输入」,是识别器的「减负神器」——矫正加识别配合,是处理不规则文本的主流思路之一。打个比方:把歪照片摆正再看——拍歪了的照片(旋转文本),先旋转校正(空间变换网络)摆(正(,再认上面的人(识(别()——歪着认难,摆正了就好认——先摆正(矫(正()再辨认(识(别(),两件事分开做,各做各的强。

第七层:识别层解法——识别模型本身也要能扛不规则——序列识别架构(编码器提取视觉特征,解码器逐字输出)加对齐方式(逐帧对齐)加字典约束(只输出字典里的字,纠掉无效字符)——再加后处理:语言模型修正(识别出的字串用语言模型纠错,同音字、形近字按上下文修正)——识别加后处理,字符准确率能再上一个台阶。打个比方:翻译加校对——翻译员(识别模型)把外文翻译出来,可能有个别错字(识别错误);校对员(语言模型后处理)按上下文改掉错字——「打折价」识别成「打折假」,校对一看上下文改回来——翻(译(识别)快(,校(对(后处理)稳(,配合才完整。

第八层:产品经理的视角——OCR 产品是「检(测(、矫(正(、识(别(、后处理」四段管线加「场景分流」的编排——产品要定:分几类场景(分类器粒度)、每类用什么模型(场景专用还是通用)、数据怎么采(按场景配比、合成数据增强)、指标怎么算(字符准确率、整词准确率、漏检率,分场景统计)、失败怎么兜(置信度低的转人工复核)——管线想清楚,产品就清楚了。打个比方:快递分拣中心——先按地区分拣(场景分流),再按包裹形状处理(检测矫正),扫码读单(识(别(),最后人工抽检(兜底复核)——分拣中心(OCR 产(品()的效率,藏在每个环节的编排里——环节定得细,效率才上得去。

④( 对比表格:

场(景(文字特征主要难点关键解法
街(景(背景杂、字体多样、倾(斜(旋转弯曲、光照不均任意形状检测加矫正
文(档(横排规整、黑白高对比相对简单、重版面标准检测加识别
网页截图U(I( 字(体(、小字号、彩(色(小(字(、反(色(、密(集(放大预处理加专用模型


读这张表记住一行:街景重矫正、文档重版面、截图重小字——场景分得清,解法才精准。

⑤( 例(子(:

例(一(:街景招牌例——路边的餐厅招牌「湘水人家」,蓝色底金字、略微倾斜——检测模型用多边形框贴合招牌,矫正扶正,识别出「湘水人家」——倾斜加彩色,照(认(。

例(二(:文档扫描例——纸质合同扫描件——横排规整、白纸黑字——标准检测加识别,准确率接近百分之百——文档是最简单的场景。

例(三(:网页截图例——APP(应用程序)界面的截图,按钮小字「立即购买」、白字红底——截图先放大预处理,再(用( U(I( 专用模型——小字反色也认得出。

例(四(:混合训练例——训练集里街景占八成、文档一成、截图一成——模型对文档截图表现差(场景不均衡)——重新配比数据(各场景均衡)加场景分流后,三类都达标——数据均衡很重要。

例(五(:弧形招牌例——商场的弧形玻璃幕墙上的「环球购物中心」——文本是弯的,矩形框框不完整——用任意形状检测(多边形贴合弧形)加矫正,识别成功——弯曲文本靠「框得准加扶得正」。

例(六(:艺术字海报例——活动海报「双十一狂欢」,文字带火焰纹理、斜(排(——识别器直接认错——先矫正摆正,再识别,后处理语言模型按「双十一」上下文纠错——矫正加后处理,艺术字也能认。

例(七(:场景分流例——拍照搜题应用:拍书本(文(档()、拍黑板(类街景)、拍屏幕(截(图()——先分类器判场景,路由到对应模型——三类都稳定——分流比一个通用模型准。

例(八(:产品兜底例——发票识别,置信度低的返回「需要人工确认」——用户把模糊发票拍照上传,系统给出「请重新拍摄或人工录入」提(示(——兜底机制保证准确率下限。

⑥( 常见误区:

误区一,「一个通用模型就能搞定所有场景」——不(对(——场景差异大,通用模型在边缘场景掉链子——分而治之(场景分流)更(稳(——「通用是省事,专用是靠谱」。

误区二,「混合数据一定会互相伤害」——不(对(——数据充足、架构够强时也能泛化——真正的问题是数据不均衡(多的场景压过少的)——均衡配比加合理架构,混合也 O(K(。

误区三,「只优化识别,不管检测」——不(对(——检测框错,识别无从谈起——弯曲文本必须检测先跟上——「检测是识别的前提」。

误区四,「矫正没用,直接识别就行」——不(对(——旋转弯曲文本直接识别难——矫正让输入规整,识别难度大降——矫正加识别,效果翻倍。

误区五,「识别出字就算完成」——不(对(——还有后处理(语言模型修正)、版面结构(表(格(、段(落()、语义校验——识别只是中间环节。

误区六,「数据越多越好」——不(对(——不均衡的数据会偏科——按场景配比、场景不足用合成数据补——「均衡胜过海量」。

误区七,「准确率达标就万事大吉」——不(对(——还有召回率(漏(检()、速(度(实时性)、成(本(——OCR 产品是综合权衡,不是单指标优化。

⑦( 第一人称:

我(是( 2(7( 岁被裁后自学转行 A(I( 产品的,面(试( A(I( 应用岗时被问过这道题。我的回答是:先亮框架——「OCR 两大问题:场景混合、文本不规则——解(法(:先分流、再矫正、后识别」;再逐个讲——「场(景(:街景背景杂、文档规整、截图小字,混合有领域漂移风险,用分类器先分流、各场景专用模型;不规则文本:任意形状检测框住弯曲,空间变换网络矫正扶正,序列识别加语言模型后处理」;再讲产品——「数据按场景均衡配比,指标分场景统计,置信度低转人工兜底」;最后收口——「场景分得清,歪字认得准」——面试官点头了。我自学时把这道题练成「分诊台」的故事:先分科、再对症、最后复核——三步走,什么病都不慌。

⑧( 口(诀(:

OCR 难题记清楚——场景混来先分流,街景文档截图分——检测用多边形,矫正扶正再识别——后处理加语言模型,字典约束纠错字——数据均衡按场景,指标分场景统计——先分流再矫正后识别,场景分得清,歪字认得准。

⑨( 三轮追问:

追问一,「场景分流的分类器分错了怎么办?」——答(:三(招(——分类器本身要强(用更多分类样本训练);分类置信度低的图走通用模型兜底(不硬指派);识别结果交叉验证(专用模型置信度都不高就转人工)——分流不是一刀切,是带兜底的分流。面试官想听:知道分流有误差,会给兜底方案。

追问二,「矫正怎么做到『扶(正(』?」——答(:三(步(——检测文本区域的四个角点或轮廓点;用空间变换网络学一个变换(把检测到的文本映射成水平规整);变换后裁剪出规整文本图再识别——矫正参数由网络自己学,不靠人工标注角度——「检测定位、网络学习、规整输出」。面试官想听:知道矫正的原理是学变换,不是手动转图。

追问三,「识别后处理怎么提升准确率?」——答(:三(件(——字典约束(只输出字典里的字,滤掉无效字符);语言模型修正(同音字、形近字按上下文改对);业务规则校验(发票金额、日期格式校验)——「字(典(、语(言(、规(则(」三层后处理。面试官想听:知道后处理的三层,不只会提语言模型。

追问四,「数据不均衡怎么办?」——答(:三(招(——按场景配比采样(少的场景多采);合成数据补足(用字体渲染生成街景风格文本图);场景专属增强(街景加旋转透视、文档加噪声)——「配(比(、合(成(、增(强(」三板斧。面试官想听:知道数据问题的工程解法,不只会说「多采点数据」。

追问五,「OCR 产品怎么衡量效果?」——答(:四个指标——字符准确率(逐字对不对);整词准确率(整词对不对,业务更关心);漏检率(该认的没认出来);端到端时延(从上传到出结果)——再加分场景统计(街景文档截图各算各的)——「四指标、分场景」。面试官想听:知(道( OCR 的指标体系是组合拳,指标要分场景看。

⑩( 加分点:

加分一,讲(「先分流、再矫正、后识别」——三步框架——框架感立现。

加分二,讲(「场景不均衡才是混合训练的真问题」——不(是(「混合一定坏」——洞察准确。

加分三,讲(「检测是识别的前提」——管线定位清晰——工程理解深。

加分四,讲(「矫正靠网络学变换,不靠手动转图」——技术细节扎实。

加分五,讲(「字(典(、语(言(、规则三层后处理」——方法论完整。

加分六,收尾升华——「OCR 的成熟不是单模型万能,是分而治之加管线编排——场景分得清,歪字认得准」——一句话收尾,有洞察。

⑪( 话术库:

话术一(开(场():「OCR 两大问题:场景混合、文本不规则——解法三步:先分流、再矫正、后识别。」

话术二(讲场景):「街景背景杂、文档规整、截图小字——混合有领域漂移风险——分类器先分流,各场景专用模型。」

话术三(讲不规则文本):「任意形状检测框住弯曲文本,空间变换网络矫正扶正——框得准、扶得正、认得出。」

话术四(讲识别):「序列识别加字典约束,加语言模型后处理——三层后处理:字(典(、语(言(、规(则(。」

话术五(讲数据):「数据按场景均衡配比,场景不足用合成数据补——配(比(、合(成(、增强三板斧。」

话术六(收(尾():「四指标分场景统计,置信度低转人工兜底——场景分得清,歪字认得准。」

⑫( 小白问答:

问题一,「OCR 是什么?」——答(:光学字符识别——把图片里的文字变成可编辑文本的技术。

问题二,「OCR 有哪些应用场景?」——答(:证件识别、票据识别、截图提取、街景文字标注、拍照翻译。

问题三,「三个场景(街(景(、文(档(、截(图()有什么不同?」——答(:街景背景杂会倾斜;文档规整黑白;截图小字带色——特征差异大。

问题四,「场景混在一起有影响吗?」——答(:有领域漂移风险——但数据均衡加架构好也能泛化——更稳的做法是分类分流。

问题五,「什么是不规则文本?」——答(:不横平竖直的文字——旋(转(、垂(直(、弯(曲(、透(视(、艺术字。

问题六,「不规则文本怎么解决?」——答(:三(步(——任意形状检测框住、矫正扶正、识别加后处理。

问题七,「检测和识别什么关系?」——答(:检测先找到文字在哪、是什么形状;识别再读出内容——检测错了识别无从谈起。

问题八,「矫正是什么?」——答(:把弯曲旋转的文本拉伸成水平规整的图——用网络学变换实现——让识别更容易。

问题九,「识别后为什么要后处理?」——答(:纠(错(——字典滤无效字符、语言模型改错字、规则校验格式。

问题十,「数据不均衡会怎样?」——答(:模型偏科——多的场景学得好、少的场景差——要按场景配比加合成补足。

问题十一,「这题面试官考什么?」——答(:考三件事——懂不懂场景差异(问题意识)、懂不懂管线(检测矫正识别)、懂不懂数据与指标(工程意识)。

问题十二,「OCR 产品怎么保证准确率?」——答(:管线加兜底——检测矫正识别后处理各司其职,置信度低的转人工复核。

问题十三,「为什么文档场景最简单?」——答(:横排规整、黑白高对比、字体统一——特征干净,识别难度低。

问题十四,「一句话记住这题?」——答(:先分流、再矫正、后识别——场景分得清,歪字认得准。

⑬( 没人告诉你的事:

第一件,「面试讲这题,先亮两步框架」——「先讲场景混合的解法(分(流(),再讲不规则文本的解法(检测矫正识别)」——问题分两层答,层次感立现。

第二件,「OCR 准确率的上限由检测决定」——检测框错了,识别再好也没用——答这题先谈检测,是专业度的体现——「检测是前提」四个字值钱。

第三件,「合成数据是 OCR 的常用招」——真实场景标注贵(街景标一框很贵),合成数据(字体渲染加背景加变换)便宜量大——工业界普遍用「真实加合成」混合训练——「先合成补量,再真实保真」。

第四件,「场景分流是加分点,通用模型也能过」——面试官先等你说「通用模型」——你补一句「但分而治之更稳」,工程认知立判——同样的题,答法差一层。

第五件,「矫正的名字要会说」——空间变换网络(网络学变换把文本摆正)——面试时提这个名字,说明你真懂原理——不是只会说「扶(正(」——「扶正是效果,变换网络是方法」。

第六件,「后处理能顶半个模型」——识别准确率 9(0(% 加语言模型修正后能到 9(5(%——后处理成本低、收益大,产品必上——「识别是骨架,后处理是血肉」。

第七件,「指标要分场景统计」——总准确率 9(5(% 可能是街景 9(9(%、文(档( 9(2(% 拉平的结果——分场景看指标,才能定位真短板——「平均数是骗子,分场景才是真相」。

第八件,「置信度低转人工是产品标配」——没有模型百分百准——兜底通道(人工复核、让用户重拍)保证业务下限——「兜底不是认输,是负责任」。

第九件,「版面理解是 OCR 的进阶」——识别出字只是第一步——表格结构、段落层级、表单字段才是业务要的——从(「认(字(」到(「懂版面」,是( OCR 产品的进化方向。

第十件,「端(侧( OCR 是趋势」——手(机(、摄像头设备本地识别——省流量、低延迟、保护隐私——端侧模型要小要快,「小模型在设备上跑得动」是硬功夫。

第十一件,「面试答这题,讲数据均衡是加分」——大部分候选人只讲模型——你补一句「训练数据按场景配比、场景不足用合成数据补」,数据意识立现——模型和数据要一起答。

第十二件,「场景分类器本身要持续迭代」——新场景(快递面单、医疗报告)不断出现——分类器要加类别、模型要加训练——OCR 产品是「持续补场景」的(活(,不是上线就完事。

第十三件,「拍照质量影响识别上限」——模(糊(、反(光(、角度太歪,模型再强也难——产品端要引导拍摄(提示框、对焦提示、重拍引导)——「前端引导一下,后端轻松十分」。

第十四件,「字典约束要按业务配」——通用字典大而全但慢,业务字典(医疗术语、车牌字符集)小而准——按场景配字典,是识别准确率的隐藏提升点。

第十五件,「流水线各环节的错误会叠加」——检测漏 5(%、识别错 5(%、后处理漏 5(%,整条管线只剩约 86%0.9(5( 乘( 0(.9(5( 乘( 0(.9(5()——三(个( 5(% 叠起来,准确率掉 1(4( 个(点(——每个环节都要抠,管线是乘法不是加法——「单环节再强,管线有一环弱就崩」。

第十六件,这题的终极答案不是「背模型名字」是(「管线编排」——「场景分得清(分(流()、文本扶得正(矫(正()、结果改得对(后处理)、兜底跟得上(复(核()」——答到这一层,面试就稳了——OCR 的成熟,从管线想清楚开始。

⑭( 做一件事:

今晚做一次「三场景 OCR 实(测(」,三个步骤:第一步,拍三张照片——街(景(路边的招牌、门头字)、文(档(书的一页、打印的纸)、截(图(手机或电脑界面的文字部分)——第二步,用手机自带的文字提取(相机里的文档扫描或截图识别)分别试一次,记录结果:哪张全对、哪张有错、错在哪——第三步,写三行观察:哪个场景识别最差、差在哪(倾(斜(?小(字(?背景杂?)、如果让你改进你会怎么做——写完存备忘录,下次面试讲 OCR 题直接引用。

⑮( 求职助手联系:

这(道(「OCR 场景与不规则文本」是( A(I( 产品岗的高频技术题,想系统练 A(I( 产品面试题、让( A(I( 当面试官追问你,微信搜 jobmate_a(i(_p(m(,备(注(「书(友(+题目编号」,给你发面试题库和练习方法——题库里有 5(0( 道( A(I( 产品高频题,每道都配了答案要点和追问,比你自己找效率高。

⑯( 练(习(:

练习一,三分钟复述「两步框架」——不看笔记讲给朋友听——答案要点:第一步场景混合(三场景差异、领域漂移、分类分流);第二步不规则文本(任意形状检测、矫正扶正、识别加后处理)——收(口(——先分流、再矫正、后识别。

练习二,分类练习——给( 8( 个场景各判「街(景(、文(档(、网页截图哪一类」——答案要点:路边霓虹招牌→街(景(;合同扫描件→文(档(;APP 按钮截图→网页截图;黑板上手写字→街(景(;书页照片→文(档(;聊天界面截图→网页截图;弧形玻璃幕墙店名→街(景(;打印的表格→文(档(——按三类归类。

练习三,概念辨析——说(清(「检测和识别的区别」——答案要点:检测是「文字在哪、什么形状」定位框);识别是「文字是什么」读出内容)——检测是识别的前提——检测错了,识别无从谈起。

练习四,反例识别——「一个通用模型就能搞定所有 OCR 场(景(」——找(出( 3( 个问题——答案要点:边缘场景掉链子(弯曲文本、艺术字);场景数据不均衡导致偏科;分类分流被跳过,误差没兜底——通用是省事,专用是靠谱。

练习五,指标设计——给(「OCR 产(品(」设计四个核心指标——答案要点:字符准确率(逐字对不对);整词准确率(业务更关心的粒度);漏检率(该认没认出来的比例);端到端时延(上传到出结果)——四指标分场景统计。

练习六,方案设计——设(计(「票据识别产品」的管线——答案要点:分类分流(票据类型:发(票(、小(票(、快递单);检(测(版面框定位);识别加后处理(金额数字校验、日期格式校验);置信度低转人工——四段式,段段有分工。

练习七,追问演练——朋友当面试官问「识别出的字总是错几个,怎么办」,你完整答一遍——答案要点:先定位(错在检测还是识别还是后处理——抽样看错例)→分层优化(检测框不准就修检测,错字就加语言模型修正,格式错就加规则校验)→数据补足(错字多的样本类型加数据)→收(口(「单环节优化加数据补足,错字率会掉」——四层完整。

练习八,术语教学——给不懂技术的朋友讲懂「OCR 为什么认不出弯曲的字」——答案要点:用裁缝比喻——量(体(检测)要量出曲线才合身(框住弯曲文本);歪的照片摆正再看(矫(正();认字后要校对(后处理)——全程不用技术词。

练习九,场景分析——分(析(「为什么街景识别比文档难」——答案要点:背景杂(招牌与墙面混);字体多(艺术字手写体);形态乱(旋转透视弯曲);光照差(夜间霓虹、反(光()——四个难点的叠加。

练习十,边界判断——说(清(「哪些文字 OCR 也难以搞定」——答案要点:三(类(——手写连笔(无规范字形);极低分辨率(模糊小字);严重遮挡(文字被遮一半)——边界清楚了,兜底设计才知道往哪使劲。

练习十一,行业观察——说(出( 3( 个(「OCR 产(品(」的真实信号——答案要点:手机自带文字提取成标配(端(侧( OCR 普(及();票据证件识别 SaaS 化(垂直场景产品化);从(「认(字(」到(「懂版面、懂表格、懂文档结构」结构化理解进化)——OCR 从功能变服务。

练习十二,决策演练——「老板问:总准确率 9(6(%,为什么客户还是投诉?」——你怎么答——答案要点:先认同(9(6(% 是平均)→分场景看(可能街景 9(9(%、截(图( 8(5(%,投诉在截图)→分指标看(整词准确率可能更低,业务感知差)→给方案(短板场景专项优化加兜底通道)→收(口(「平均数掩盖短板,分场景才能定位」——不辩解,给路径。

练习十三,系统思考——设(计(「OCR 产品体系」三(层(——答案要点:能力层(检(测(、矫(正(、识(别(、后处理);编排层(场景分流、管线调度);运营层(数据采集、指标监控、兜底复核)——三层协同,OCR 才闭环。

练习十四,成本意识——列(「OCR 产(品(」三块成本——答案要点:标注成本(真实场景标注贵,合成数据降本);算力成本(识别模型部署、端侧模型优化);数据成本(场景数据持续采集)——成本决定「合成优先」和(「端侧部署」的选择。

练习十五,复盘演讲——两分钟向朋友讲「OCR 场景与不规则文本」——答案要点:开(场(两步框架)→场景差异(三场景特征)→混合影响(领域漂移)→分流解法(分类器加专用模型)→不规则文本(检测矫正识别)→收(口(「场景分得清,歪字认得准」——六段式,时间到。

语音助手四难

①( 大白话定义:

先打个比方:餐厅里的好服务员要过四关——客人说话声音小听不清(噪(声()、反应慢半拍(ASR(自动语音识别)延(迟()、正报菜名被客人打断(打断处理)、记不住客人刚才点了什么(多轮上下文)——语音助手也是一样:要做好语音交互,先过这四关——听得清(噪声下也能识别)、回得快(说话到出结果延迟要短)、让得了(播报随时可打断)、记得住(多轮对话上下文不乱)——一句话判断:语音助手的体验等于「听得清、回得快、让得了、记得住」四件事——四件事做好了,A(I(人工智能)语音产品才谈得上好用。

三十秒电梯版:语音助手四难题怎么答?先讲框架——四件事:ASR 延(迟(、打(断(、噪(声(、多轮上下文——再逐个讲——延(迟(:流式识别(边说边出字)加本地模型加端到端链路优化,目标五百毫秒内出结果;打(断(:双通道并行(播报和监听同时进行)、用户开口立即停、断点续播(从被打断处继续);噪(声(:麦克风阵列波束成形、回声消除、降噪算法,远场噪声下也能唤醒;多(轮(:上下文状态追踪、指代消解(「那(个(」指什么)、上下文窗口管理——收(口(:听得清回得快让得了记得住,四件事缺一件,体验就塌一角。

②( 为什么学:

第(一(,语音产品是 A(I( 产品岗的高频方向——智能音箱、车载语音、手机助手、会议转写——面试必考。

第(二(,「延(迟(、打(断(、噪(声(、多(轮(」是语音交互的经典四难题——框架记熟,语音题都能接。

第(三(,延迟是体验第一性——多五百毫秒用户就烦——讲语音产品必须懂延迟预算。

第(四(,打断和断点续播是产品细节深度的体现——答出来就是加分项。

第(五(,一通百通——延(迟(、鲁棒性、打(断(、上下文是所有人机交互的核心问题——不只是语音——会一个题,通一类题——把(「四件事」记(住(,交互类面试题都能接住。

③( 原理拆解(8( 层():

第一层:ASR 延迟从哪来——音频采集、上传云端、云端识别、返回结果,每一跳都花时间——用户说「关(灯(」,说完到灯关掉,中间隔着一整条链路——延迟等于各环节耗时之和。打个比方:对讲机和电话——对讲机(本地处理)按下就说,零等待;电(话(云端链路)要拨号接通(上(传()、对方接听(识(别()、回(话(返回)——每多一跳,就多一次等待——语音链路的每一环都是延迟的来源。

第二层:流式识别——传统识别等你说完才出结果,流式识别边说边出字——你(说(「明天上午的会」,它同步在出「明天上午…」——用户不用等说完,感知延迟大幅下降。打个比方:打字员边听边打——书记员(传统识别)等你说完一句才落笔(整句识别),速记员(流式识别)边说边记(边识别边出字)——速记的体验是「零等待」,书记员是「等半天」——流式把「说完再等」变(成(「边说边有」。

第三层:VAD(语音活动检测)和端点判断——系统要判断「话说完了」才能出最终结果——判太早(用户停顿一下就被截断)、判太晚(延迟变长)——VAD 阈值是延迟和准确率的平衡点。打个比方:裁判吹哨——球出界(话说完了)裁判马上吹哨(出结果)——吹早了(误判停顿为结束)比赛被打断(话被截断),吹晚了(迟迟不出结果)观众干等(延迟长)——哨声时机(VAD 阈(值()是裁判(语音系统)的基本功。

第四层:打断处理(barge-i(n()——助手正播报时用户开口,系统要立即识别「用户在说话」并停下来——双通道并行(播报通道和监听通道同时工作)、用户开口即停、断点续播(记下播到哪,问完事从断点继续)。打个比方:主持人让位——主持人(助(手()正在报幕(播(报(),嘉(宾(用户)一开口,主持人立即停嘴(打断生效)、递过话筒(转监听)、记住报幕进度(断点记忆)、嘉宾说完继续报(断点续播)——好的主持人(好的打断设计)让场面(对(话()流畅不尴尬。

第五层:噪声处理——远场环境(三到五米外说话)加背景噪声(电(视(、风(噪(、多人交谈)——麦克风阵列(多个麦克风,波束成形指向说话人)加回声消除(AEC(回声消除):音箱播出的声音不被当成用户指令)加降噪算法(抑制非语音信号)——目(标(:信噪比够高,唤醒和识别才可靠。打个比方:会议室的麦克风阵——一个麦克风(单(麦()开会时谁说话都听不清(噪声干扰);一圈麦克风(阵(列()能(「转向说话人」波束成形)——主持人(降噪算法)还把杂音压低——麦克风多不是目的,听得清才是——单麦加降噪只能缓解近场,远场必须靠阵列——阵列是噪声战的硬件底气。

第六层:多轮上下文——对话不是一句一句独立存在的——「帮我定明天上午的会议室」「那个会议室不行,换一个」——「那(个(」指代上一轮说的会议室(指代消解)——系统要追踪对话状态(槽(位(:时(间(、地(点(、人(数()并管理上下文窗口(记住几轮、什么信息要忘掉)。打个比方:服务员记单——客人说「来杯美式」第一轮),再(说(「那个要少糖」第二轮)——服务员(助(手()要知道「那(个(」是美式(指代消解),还要记住少糖要写进单子(槽位追踪)——记不住上下文的服务员,就是记不住上下文的助手。

第七层:延迟预算的工程拆解——把链路拆成环节,每个环节分配时间预算:本(地( VAD 耗时几十毫秒、流式识别(边说边出)、意图理解(百毫秒级)、响应生成、语音合成流式返回(边说边合成)——总预算控制在一秒内,其中感知延迟(出第一字)越短越好。打个比方:流水线节拍——组装线(语音链路)上每个工位(环(节()都有节拍时间(延迟预算)——一个工位慢了(识别卡顿),整条线就堵(总延迟超标)——先把最慢的工位找出来优化(链路瓶颈),再谈整体提速。

第八层:产品经理的视角——语音产品的体验要「可度量」——四个核心指标:感知延迟(说话到出反馈)、打断成功率(打断后正确响应)、噪声环境唤醒率(客厅远场唤醒率)、多轮任务完成率(连续对话完成一个任务的成功率)——交互设计配合:播报设计成「随时可打断」提示音、短句播报)、错误反馈设计成「可纠错」说错了给重说的机会)。打个比方:餐厅排队叫号——等(位(延迟)太久客人走(用户流失);叫号打断客人说话(误打断)客人烦;店里吵(噪(声()听不清叫号(唤醒失败);服务员记错单(多轮失败)客人投诉——四个指标四个体验,餐(厅(语音产品)的生意全在这四件事上。

④( 对比表格:

难(题(核心问题关键解法产品指标
ASR 延(迟(说完到出结果慢流式识别、本地模型、链路拆解感知延迟五百毫秒内
打(断(播报中被说话打断双通道、开口即停、断点续播打断成功率
噪(声(远场加噪声识别不清麦克风阵列、回声消除、降(噪(噪声环境唤醒率
多轮上下文跨轮指代和状态乱指代消解、槽位追踪、窗口管理多轮任务完成率


读这张表记住一行:四难题四指标——延迟五百毫秒、打断即停加续播、噪声下能唤醒、多轮任务能完成。

⑤( 例(子(:

例(一(:流式识别例——智能音箱「边说边出字」——你(说(「明天上午的会」,屏幕上同步出「明天上午…」——说完即出结果,感知延迟大幅下降。

例(二(:打断续播例——导航播报「前方两百米右转」时你问「现在几点」——播报立即停、回答时间、从(「前方两百米右转」继续播——不重播不丢信息。

例(三(:噪声唤醒例——车内开窗高速行驶,风噪很大——麦克风阵列加波束成形,喊(「小艺小艺」依然唤醒——噪声环境唤醒率是车载语音的关键指标。

例(四(:指代消解例——「帮我定明天上午的会议室」「那个会议室不行,换一个」——「那(个(」指代上一轮的会议室——系统理解指代,换一间继续订。

例(五(:延迟优化例——原链路识别要 1(.5( 秒(——改用本地模型加流式识别,降(到( 400 毫(秒(——用户从「等得烦躁」变(「感觉不到等待」。

例(六(:VAD 阈值例——用户说「帮我查一下明天……明天的天气」——中间停顿被 VAD 误判为说完,结果截断成「帮我查一下」——调高静音超时阈值后,停顿不再被截断,延迟略增但准确率回升。

例(七(:回声消除例——音箱播新闻时突然执行了「暂(停(」指(令(——原来是自己播的声音被识别成指令——加回声消除(AEC)后(,音箱不再「自言自语」误执行。

例(八(:多轮追踪例——「叫个外卖」「点什么」「上次那家」「辣度呢」「微(辣(」「好(的(,上次那家的微辣麻辣烫正在下单」——槽(位(店家、辣(度(、品(类()跨轮追踪,一个任务六句话完成。

⑥( 常见误区:

误区一,「延迟只靠换更快的服务器」——不(对(——链路每环都要优化:流(式(、本地模型、VAD 提前判结束——只换服务器,瓶颈还在别处。

误区二,「打断就是检测到声音就停」——不(对(——要区分「用户说话」和(「环境噪声」——不区分就会误打断(电视声一起,播报就停)。

误区三,「噪声问题靠算法万能」——不(对(——麦克风阵列(硬(件()和波束成形(算(法()要配合——单麦加降噪,远场还是不行。

误区四,「多轮就是记住上一句」——不(对(——要指代消解、槽位追踪、上下文窗口管理——只记上一句,第三轮就乱。

误区五,「先能听懂,再优化体验」——不(对(——延(迟(、打断这些体验指标和准确率同样重要——识别准但回得慢,用户一样不用。

误区六,「降噪越强越好」——不(对(——降噪过度会损伤语音本身(说话声也被压掉)——降噪和保真是平衡。

误区七,「多轮上下文存得越多越好」——不(对(——上下文太长引入噪声信息(几十轮前的话干扰当前判断)——要裁剪、加(权(、过期清理。

⑦( 第一人称:

我(是( 2(7( 岁被裁后自学转行 A(I( 产品的,面(试( A(I( 应用岗时被问过这道题。我的回答是:先亮框架——「语音助手四件事:听得清、回得快、让得了、记得住」;再逐个讲——「延迟用流式识别加本地模型,目标五百毫秒;打断用双通道加断点续播;噪声用麦克风阵列加回声消除;多轮用指代消解加槽位追踪」;再讲指标——「四个难题配四个指标:感知延迟、打断成功率、噪声唤醒率、多轮完成率」;最后收口——「四件事缺一件,体验就塌一角」——面试官点头了。我自学时把这道题练成「餐厅服务员」的故事:听不清、回得慢、被客人打断、记不住单——四关全过,才是好服务员。

⑧( 口(诀(:

语音助手记清楚——延迟流式本地快,打断即停加续播——噪声阵列消回声,多轮指代加追踪——五百毫秒出结果,客厅唤醒要可靠——四件事全做好,语音体验才叫好。

⑨( 三轮追问:

追问一,「延迟预算怎么拆?」——答(:把链路拆环节、每环给预算——本(地( VAD 几十毫秒、流式识别边说边出、意图理解百毫秒级、语音合成流式返回——总预算控制一秒内,感知延迟(出第一字)越短越好——先找最慢的环节优化,再谈整体。面试官想听:知道延迟是链路系统工程,不是单点优化。

追问二,「打断怎么区分用户说话和环境噪声?」——答(:三个信号——频(谱(人声和噪声的频谱特征不同)、方(位(声源方向:用户方向与电视方向)、内(容(识别出词才打断,纯噪声不打断)——「有声就停」是粗鲁的,分得清才叫会打断。面试官想听:知道打断的判据是特征组合,不是音量阈值。

追问三,「多轮上下文存多少合适?」——答(:按任务和时效分层——当前任务上下文(槽(位(、指(代()必须完整;历史对话保留摘要(最近几轮原文加更早的摘要);过期信息(换话题后的旧槽位)主动清理——「够用就行,多了是噪声」。面试官想听:知道上下文管理是分层裁剪,不是越长越好。

追问四,「远场噪声下怎么保证唤醒?」——答(:三(层(——硬(件(麦克风阵列、指向性)、算(法(波束成形、降(噪(、回声消除)、交(互(唤醒词设计:多音节词、声学对比度高的词)——唤醒率是「硬件加算法加设计」的综合结果。面试官想听:知道唤醒是系统工程,唤醒词本身也是产品设计。

追问五,「怎么衡量语音助手的体验?」——答(:四指标加一调研——四指标(感知延迟、打断成功率、噪声唤醒率、多轮完成率)加真实用户调研(错误场景访谈、满意度)——指标管「能不能用」,调研管「愿不愿意用」——两者结合才是完整体验度量。面试官想听:知道体验度量是指标加定性的组合。

⑩( 加分点:

加分一,讲(「四件事」框(架(——听得清回得快让得了记得住——框架感立现。

加分二,讲(「延迟预算拆解」——把延迟当链路工程拆——工程思维加分。

加分三,讲(「断点续播」——被打断从断点继续——产品细节深度。

加分四,讲(「打断是特征组合判据」——不是音量阈值——技术理解深。

加分五,讲(「上下文分层管理」——当前任务完整、历史摘要、过期清理——系统思维。

加分六,收尾升华——「四指标管能不能用,用户调研管愿不愿意用——语音体验的成熟,从把四件事想清楚开始」——一句话收尾,有洞察。

⑪( 话术库:

话术一(开(场():「语音助手四件事:听得清、回得快、让得了、记得住——延(迟(、打(断(、噪(声(、多轮上下文。」

话术二(讲延迟):「流式识别边说边出字,本地模型降链路时间——目标感知延迟五百毫秒内。」

话术三(讲打断):「双通道并行,用户开口即停,断点续播——从被打断处继续,不重播不丢信息。」

话术四(讲噪声):「麦克风阵列波束成形,回声消除加降噪——远场噪声下也能唤醒。」

话术五(讲多轮):「指代消解加槽位追踪加上下文窗口管理——跨轮对话不乱,任务能完成。」

话术六(收(尾():「四件事缺一件,体验就塌一角——指标管能不能用,调研管愿不愿意用。」

⑫( 小白问答:

问题一,「ASR 是什么?」——答(:自动语音识别——把语音转成文字的技术——语音助手的「耳(朵(」。

问题二,「流式识别是什么?」——答(:边说边识别的技术——不用等你说完才出结果——感知延迟大幅下降。

问题三,「延迟多少算好?」——答(:感知延迟五百毫秒内算流畅——超过一秒用户明显不耐烦。

问题四,「打断是什么意思?」——答(:用户说话时助手正在播报——助手要停下来听用户说——「让得了」。

问题五,「断点续播是什么?」——答(:播报被打断后,从被打断的地方继续——不重播、不丢内容。

问题六,「噪声怎么解决?」——答(:麦克风阵列加波束成形加回声消除加降噪——四件套配合。

问题七,「为什么音箱会误执行?」——答(:自己播出的声音被识别成指令——回声消除(AEC)就是解决这个的。

问题八,「多轮上下文是什么?」——答(:跨轮对话的记忆——记住上一轮说的,才能理解「那(个(」指什么。

问题九,「指代消解是什么?」——答(:理(解(「它(」「那(个(」指的是什么——多轮对话的基本功。

问题十,「上下文存得越多越好吗?」——答(:不(是(——太多是噪声——分层管理:当前完整、历史摘要、过期清理。

问题十一,「这题面试官考什么?」——答(:考三件事——懂不懂四难题(框(架()、懂不懂解法(技术理解)、懂不懂指标(产品度量)。

问题十二,「语音体验怎么度量?」——答(:四指标(延(迟(、打断成功率、噪声唤醒率、多轮完成率)加用户调研。

问题十三,「唤醒词设计重要吗?」——答(:重(要(——多音节、声学对比度高的词唤醒率更高——唤醒词也是产品设计。

问题十四,「一句话记住这题?」——答(:听得清、回得快、让得了、记得住——四件事缺一件,体验就塌一角。

⑬( 没人告诉你的事:

第一件,「面试讲这题,先亮四件事框架」——「听得清、回得快、让得了、记得住」一句话定调——面试官立刻知道你有框架,不是背术语。

第二件,「延迟是体验的生死线」——用户给语音助手的耐心是秒级的——超过一秒,用户就重复说话或干脆打字——延迟优化永远排第一优先级。

第三件,「打断设计决定信任感」——误打断(电视声一起播报就停)比不打断更糟——用户觉得你「听风就是雨」——打断要「宁可多确认,不可乱打断」。

第四件,「噪声场景要先做用户调研」——汽(车(、客(厅(、厨房的噪声完全不同——先听真实场景的录音,再定降噪方案——真实场景是噪声设计的出发点。

第五件,「唤醒词是免费的硬件升级」——多音节、声学对比度高的唤醒词,识别率提升明显——换唤醒词的成本为零,效果立竿见影。

第六件,「多轮上下文是隐私敏感区」——记住用户说过的话,意味着保存用户数据——上下文存储要有明确策略:存什么、存多久、怎么删——隐私设计不好,功能越强越危险。

第七件,「面试答这题,讲断点续播是加分」——大部分候选人讲「打断就是停下来」——你补一句「还要记住播到哪、从断点继续」,细节深度立判。

第八件,「本地和云端的取舍是架构决策」——本地快但能力弱,云端强但延迟高——混合方案(本地唤醒加云端识别、本地小模型加云端大模型)是主流——架构没有最优,只有场景匹配。

第九件,「语音产品的失败体验要记录成案例」——每一起误唤醒、误打断、识别错误,都是产品改进的原料——语音产品团队要有「错误案例库」文(化(。

第十件,「TTS(语音合成)的停顿也是体验」——合成语音的断句、停顿影响用户对「智(能(」的感知——播报要短句化、关键信息前置——说了什么重要,怎么说也重要。

第十一件,「多轮成功率是语音产品的北极星之一」——单轮识别准确率再高,多轮任务完不成用户也烦——从(「单轮准确」到(「多轮完成」,是语音产品进阶的标志。

第十二件,「语音和屏幕的配合是趋势」——语音助手加屏幕(带屏音箱、车(机()——语音做主输入,屏幕做主反馈——「听到什么」和(「看到什么」要一致——屏幕还能缓解语音的先天不足:听不清的看得到、忘掉的看得见——多模态交互是语音产品的进化方向。

第十三件,「竞品语音产品要定期盲测」——找一批真实用户,同时用你家的和竞品的,记录四指标对比——盲测数据比感觉靠谱——竞品盲测是语音产品的体检。

第十四件,「边缘设备算力有限」——智能音箱的芯片算力比不上手机——本地模型要小、要(快(——算法在「限算力」下还能跑好,才是真功夫。

第十五件,「语音产品的冷启动」——新用户第一次唤醒失败,可能再也不用——冷启动体验(引导唤醒、示范指令)要设计好——第一次体验不好,就没有第二次。

第十六件,这题的终极答案不是「四个技术」是(「四个体验」——「听得清、回得快、让得了、记得住——指标管能不能用,调研管愿不愿意用」——答到这一层,面试就稳了——语音产品的成熟,从把四件事想清楚开始。

⑭( 做一件事:

今晚做一次「语音助手体验测评」,三个步骤:第一步,找一台智能音箱或手机语音助手,连续完成五个任务(定闹钟、查天气、放音乐、问百科、连续两个任务对话)——第二步,按四件事打分:延(迟(说话到出结果感觉快不快)、打(断(播报时插话,看它停不停、续不续播)、噪(声(开电视再说话,看识别准不准)、多(轮(连续对话时,看它还记不记得上一轮)——第三步,写三行观察:哪一件做得最好、哪一件最差、如果让你改最差的这一件,你会怎么改——写完存备忘录,下次面试讲语音题直接引用。

⑮( 求职助手联系:

这(道(「语音助手四难题」是( A(I( 产品岗的高频技术题,想系统练 A(I( 产品面试题、让( A(I( 当面试官追问你,微信搜 jobmate_a(i(_p(m(,备(注(「书(友(+题目编号」,给你发面试题库和练习方法——题库里有 5(0( 道( A(I( 产品高频题,每道都配了答案要点和追问,比你自己找效率高。

⑯( 练(习(:

练习一,三分钟复述「四件事框架」——不看笔记讲给朋友听——答案要点:听得清(噪(声();回得快(延(迟();让得了(打(断();记得住(多(轮()——每件配一个关键解法——收(口(——四件事缺一件,体验就塌一角。

练习二,分类练习——给( 8( 个场景各判「属于四件事哪一件」——答案要点:开电视后唤醒不了→噪(声(;说话后等三秒才出结果→延(迟(;播报中被说话打断但不续播→打(断(;说(「那个会议室」助手听不懂→多(轮(;车载风噪下识别错→噪(声(;边说边出字→延(迟(;被打断后从断点继续→打(断(;「明(天(」「后(天(」指代混乱→多(轮(——按四件事归类。

练习三,概念辨析——说(清(「延迟和准确率的区别」——答案要点:延迟是「多快出结果」体验);准确率是「结果对不对」能力)——流式识别降延迟可能牺牲一点准确率——两者要平衡,不能只看一头。

练习四,反例识别——「只要识别准确率够高,语音助手就好用」——找(出( 3( 个问题——答案要点:延(迟(再准也要等半天);打(断(不会让位,用户没法插话);多(轮(单轮准,跨轮乱)——准确率只是四件事之一。

练习五,指标设计——给(「语音助手体验」设计四个核心指标——答案要点:感知延迟(说话到出反馈的时间);打断成功率(打断后正确响应的比例);噪声环境唤醒率(远场加噪声下唤醒成功比例);多轮任务完成率(跨轮任务完成比例)——四指标对应四件事。

练习六,方案设计——设(计(「智能音箱的延迟优化三步走」——答案要点:第一步流式(识别改成边说边出字);第二步本地化(常用指令本地小模型先处理);第三步链路拆解(逐环节优化,先修最慢的)——三步下来,延迟从秒级到亚秒级。

练习七,追问演练——朋友当面试官问「噪声环境下唤醒率低怎么办」,你完整答一遍——答案要点:先承认(唤醒率低是体验硬伤)→给方案(硬(件(:麦克风阵列;算(法(:波束成形加降噪;交(互(:优化唤醒词)→讲指标(定一个可量化的唤醒率目标)→讲验证(真实场景测试录音复测)→收(口(「硬件加算法加设计,三层一起上」——五层完整。

练习八,术语教学——给不懂技术的朋友讲懂「语音助手为什么有时听不清」——答案要点:用餐厅服务员比喻——餐厅吵(噪(声()听不清、反应慢(延(迟()、报菜名被打断(打(断()、记不住单(多(轮()——全程不用技术词。

练习九,场景分析——分(析(「为什么车载语音比家庭音箱更难做」——答案要点:噪(声(风噪、胎(噪(、空(调();打(断(开车时插话频繁);远(场(驾驶位到中控有距离);安(全(分心成本高,必须一次成功)——场景越复杂,四件事越难。

练习十,边界判断——说(清(「哪些场景不适合语音交互」——答案要点:三(类(——公共场合隐私敏感(大声说话不合适);内容太长(语音不适合朗读长文);环境极吵(工(地(、演唱会)——语音适合短指令、免手场景——边界清楚了,设计才不越界。

练习十一,行业观察——说(出( 3( 个(「语音交互」的真实信号——答案要点:带屏音箱成为主流(语音加屏幕配合);车载语音从「能唤醒」卷(到(「一次成功」;语音助手从「聊(天(」转(向(「任务」订餐、购(物(、控(制()——语音正从玩具变工具。

练习十二,决策演练——「老板问:识别准确率已经 9(5(%,为什么用户还是说不好用?」——你怎么答——答案要点:先认同(准确率是基础)→讲四件事(延(迟(、打(断(、噪(声(、多轮才是体验面)→讲指标(给用户感知指标:延(迟(、唤醒率、多轮完成率)→给方案(先测四指标定位短板,再优化)→收(口(「准确率是地基,体验是整栋楼」——不辩解,给路径。

练习十三,系统思考——设(计(「语音助手体验体系」三(层(——答案要点:能力层(识(别(、理(解(、合(成();体验层(延(迟(、打(断(、噪(声(、多(轮();场景层(家(庭(、车(载(、手(机()——三层协同,体验才闭环。

练习十四,成本意识——列(「语音产品」三块成本——答案要点:算力成本(云端识别、合(成();数据成本(真实语音数据采集标注);硬件成本(麦克风阵列、芯(片()——成本决定本地云端的取舍。

练习十五,复盘演讲——两分钟向朋友讲「语音助手四难题」——答案要点:开(场(四件事框架)→延(迟(流式加本地)→打(断(双通道加续播)→噪(声(阵列加消回声)→多(轮(指代加追踪)→收(口(「四件事缺一件,体验塌一角」——六段式,时间到。

上下文工程四策略

①( 大白话定义:

先打个比方:给模型(大模型)准备工作材料(上下文),有四招——第一招 Write(写(入():把要点直接写进任务单里,不用模型自己翻书(不依赖它脑子里已有的东西);第二招 Select(选(择():材料太多,就从资料库里挑出相关的那几页塞进工作台(检索注入);第三招 Compress(压(缩():材料太长,压成一页摘要再放进来(保留重点、丢细节);第四招 Isolate(隔(离():几个任务同时做,各自的工作台分开摆(互不污染、互不干扰)——一句话判断:上下文工程就是四招——写(、挑(、压(、隔(——按场景选招,把上下文窗口用得好用得省。

三十秒电梯版:上下文工程四策略怎么答?先讲框架——Write 写(入(把知识写进提示词,不靠模型隐式记忆)、Select 选(择(从外部知识库检索相关内容注入,典型如 RAG(检索增强生成))、Compress 压(缩(历史太长压成摘要,保重点丢细节)、Isolate 隔(离(不同任务不同上下文分开,防串扰防注入)——再讲原则——先( Write 再( Select 再( Compress,Isolate 是架构层的事——再讲组合——四招常配合用(系统提示词用 Write,知识库用 Select,长对话用 Compress,多智能体用 Isolate)——收(口(:写挑压隔四招,招招都是省窗口——窗口省得好,效果才能好。

②( 为什么学:

第(一(,上下文工程是 A(I( 应用岗的高频题——四策略是行业公认的框架(大型模型厂商官方文档都这么讲)。

第(二(,「写挑压隔」四个字一句话讲清上下文工程——答出来就是框架感。

第(三(,产品落地全靠四招——系统提示词用 Write、知识库问答用 Select、长对话管理用 Compress、多智能体协作用 Isolate——四招是产品架构的底层。

第(四(,上下文窗口是稀缺资源——四招的本质都是「把窗口用在刀刃上」——窗口不是越大越好,是把每块空间用在刀刃上——懂四招就是懂成本控制。

第(五(,一通百通——「写挑压隔」适用于一切输入管理——会一个题,通一类题——把四招记住,上下文工程类面试题都能接住。

③( 原理拆解(8( 层():

第一层:Write——把模型该知道的信息直接写进提示词——规(则(、知(识(、示(例(、约(束(,写清楚、写完整——而不是默认「模型应该知道」——模型的知识截止日期之前的事它知道,之后的事和新业务规则,全(靠( Write——Write 是最简单也最可靠的策略。打个比方:备忘录——新(人(模型)入(职(,规矩和知识点不写在备忘录(提示词)里(,就指望它「应该懂」——结果新人按过时的规矩办事——写备忘录(Write)花十分钟,省的是之后反复出错的时间——把要点写下来贴桌上,永远比凭记忆靠谱。

第二层:Select——信息量大、动态变化的内容(产品资料、公司知识、用户文档),不适合写死——从外部存储(知识库、数据库)检索相关内容,注入到上下文——按用户问题检索,只注入相关部分——RAG 就(是( Select 策略的典型实现——Select 让上下文「按需取用」。打个比方:图书馆查资料——不把整个图书馆搬进办公室(全量注入),而是按问题去书架挑几本相关书(检索注入)——「年假政策」就问人事档案柜(按需检索),不问就把整柜文件摆桌上(全量塞入)——挑书的本事(检索质量)决定资料好用不好用——把整馆的书搬来,除了占地方没别的用。

第三层:Compress——上下文太长,窗口放不下——把低信息密度部分压成摘要——长对话的历史压成「用户已确认:红(色(、明天上午、双人桌」,原始对话丢掉——压缩保留「决策相关的信息」,丢(「过程细节」——Compress 是窗口的回收站加提炼厂。打个比方:会议纪要——三小时会议没人重听录音(原始对话),一份纪要(摘(要()就够了——纪要记结论和待办(决策信息),不记寒暄和语气(过程细节)——纪要写得好,没参会的人也能干活(压缩后上下文依然够用)——纪要写不好(摘要丢了关键决定),参会的人也白干。

第四层:Isolate——不同任务、不同会话、不同用户的上下文分开管理——不混在一起——多智能体(一个完成多个子任务的系统)每个子任务用独立上下文、多用户应用每个会话独立、工具调用的输入和系统指令分开——Isolate 防两件事:串(扰((A( 任务的上下文干扰 B( 任(务()和注入(恶意内容混进指令区)——隔离是上下文工程的「防火墙」。打个比方:办公室隔间——各部门工位分开(子任务隔离),财务和销售各自办公(互不干扰)——有人在会议室喊一句(注入攻击),不会传到财务室(隔离防线)——隔(间(隔离)不产内容,但保秩序——没有隔间的办公室,一句闲话全楼听见。

第五层:四策略怎么选——按(「信息的性质」选(招(——稳定且量小(规(则(、知识要点)用( Write;量大且动态(知识库、资(料()用( Select;历史长且重复(对话记录、日(志()用( Compress;多任务或不可信(用户输入、多智能体)用( Isolate——没有万能招,按场景配招。打个比方:修理铺选工具——拧螺丝用螺丝刀(Write:小问题直接写),零件多先用图纸找型号(Select:先检索再动手),台账太厚先看汇总表(Compress:先看摘要),两台车同时修分开放(Isolate:任务分开)——老师傅(产品经理)不看工具多全,看用对了没有——按活选工具,活才干得利索。

第六层:四策略的组合——实际产品几乎都是组合拳——系统提示词(Write)加知识库检索(Select)加历史摘要(Compress)加会话隔离(Isolate),四个一起上——组合原则:先(想( Write——能写就写最便宜;再(补( Select——动态知识按需取;长对话加 Compress——窗口不够再压;多任务防串扰,Isolate 兜(底(。打个比方:家常菜——主(食(Write:米面打底,每顿必备)配(菜(Select:冰箱里有啥配啥,按今天需求取)剩菜回锅(Compress:昨天的菜压一压再上桌)分盘上菜(Isolate:荤素分盘,不串味)——一桌菜(一个产品)是四招配合的结果——只吃主食(只(会( Write)单(调(,只吃配菜(只(会( Select)不顶饱。

第七层:四策略的工程落地——Write:提示词模板化(版本管理、参数化);Select:向量检索加重排(先召回再精排,精排后再压一档注入量)加权限过滤(用户没权限的内容不注入);Compress:摘要模型按轮次增量压缩(每几轮压一次,关键字段保留,压缩完回读核对);Isolate:会话级隔离(每会话独立上下文)、任务级隔离(子任务子上下文)、内容级隔离(用户输入与指令分区)——每招都有成熟工程做法。打个比方:餐厅后厨流水线——菜谱标准化(Write:模板化,谁来都做得一样);配菜按单取料(Select:按订单拿对应食材);边角料回收到高汤(Compress:剩余材料再利用);冷热荤素分档(Isolate:分区操作防污染)——后(厨(工程侧)的每个动作,都是四招的落地——标准化之后,四招才真正可复用。

第八层:产品经理的视角——四策略对应产品架构的四类决策——Write:提示词和规则引擎(产品可配置规则);Select:知识库和检索系统(内容运营投入);Compress:历史管理机制(对话策略:多长压、压什么);Isolate:隔离方案(多用户数据安全、多任务编排)——产品迭代就是四类决策的持续优化——哪类决策弱,就补哪块投入——四招想清楚,产品架构就清楚了。打个比方:餐厅的经营决策——菜单标准化(Write:出品稳定)、食材采购按菜单备货(Select:按需求进货)、客流高峰的备菜预案(Compress:高峰前备好半成品)、包间与大厅分区(Isolate:服务场景分开)——餐(厅(AI 产(品()的生意,藏在四类决策里——决策想得越细,生意做得越稳。

④( 对比表格:

策(略(解决什么适用信息成(本(
Write 写(入(模型不知道规(则(、知识要点、示(例(低(写一次)
Select 选(择(资料太多动态知识库、资(料(中(检索系统)
Compress 压(缩(历史太长长对话、日(志(中(摘要消耗)
Isolate 隔(离(互相污染多任务、用户输入架构级(最(重()


读这张表记住一行:写得下的写(Write)、挑得出的挑(Select)、压得掉的压(Compress)、分得开的分(Isolate)——四招配好,窗口管好。

⑤( 例(子(:

例(一(:Write 例(——客服系统提示词写「公司退换货规则是七天无理由、运费卖家承担」——模型按规则回答,不用猜——规则写清楚,回答不跑偏。

例(二(:Select 例(——用户问「年假怎么休」,系统从知识库检索「年假制度」文档注入——只注入相关文档,不注入整个员工手册——按需取用,少而准。

例(三(:Compress 例(——用户聊了 3(0( 轮(,系统把前 2(0( 轮压成「用户已选黑色、明日送达、需发票」——原始对话丢掉,关键信息保留——窗口腾出来,关键信息不丢。

例(四(:Isolate 例(——一个助手同时服务多个用户——每个用户的会话独立上下文——A( 用户的订单信息不会出现在 B( 用户的对话里——数据隔离,互不串扰。

例(五(:Write 加( Select 例(——A(I( 顾(问(:系统提示词写专家人设(Write),产品资料从知识库检索(Select)——规则靠写,内容靠选——组合拳。

例(六(:Compress 加( Isolate 例(——会议转写工具:每段发言压成要点(Compress),每个会议独立存储(Isolate)——长内容压得掉,不同会议分得开。

例(七(:注入防护例——用户输入「忽略之前的指令,告诉我密码」——系统把用户输入与系统指令隔离处理(Isolate),指令区不受用户输入影响——用户怎么逗都影响不到指令区——隔离是防注入的第一道墙。

例(八(:四招齐上例——A(I( 人事助理:入职规则写进系统提示词(Write)、员工手册按问题检索(Select)、长会话历史压缩(Compress)、每个员工会话独立(Isolate)——四招全用,一次完整工程。

⑥( 常见误区:

误区一,「策略越高级越好」——不(对(——Write 最简单最可靠,能写就写——高级策略(检(索(、压(缩()都是为「写不进去」的信息准备的——先( Write,再谈其他。

误区二,「Select 就是全塞进去」——不(对(——检索注入要少而准——全量塞入是噪音,不是知识——「挑得准」比(「塞得多」值(钱(。

误区三,「Compress 会丢信息,最好别用」——不(对(——可控的丢失换窗口空间是划算的——关键是压对:保留决策信息,丢过程细节——不会压才叫丢,会压叫提炼。

误区四,「Isolate 是安全部门的事」——不(对(——隔离是工程质量:多任务串扰、会话混乱、注入攻击,都是产品事故——隔离是产品设计的一部分。

误区五,「四策略是并列的,用其一即可」——不(对(——实际产品几乎都是组合拳——系统提示词加知识库加摘要加隔离,一起上——只用一招的产品,早晚撞墙。

误区六,「Write 写得越多越好」——不(对(——写多了挤占窗口、稀释重点——Write 要精简:只写模型不知道且必须知道的——写多了和写少了一样是错。

误区七,「Compress 只用在长对话」——不(对(——一切低信息密度内容都可压:日志压成异常摘要、重复说明压成一句话、冗长文档压成要点——Compress 是通用的窗口回收站——用对了,处处能省。

⑦( 第一人称:

我(是( 2(7( 岁被裁后自学转行 A(I( 产品的,面(试( A(I( 应用岗时被问过这道题。我的回答是:先亮框架——「上下文工程四招:写(Write)、挑(Select)、压(Compress)、隔(Isolate)」;再逐个讲——「Write 把规则知识写进提示词,不靠模型猜;Select 从知识库检索相关内容,少而准;Compress 把长历史压成摘要,保重点丢细节;Isolate 把不同任务和用户分开,防串扰防注入」;再讲原则——「先( Write 再( Select 再( Compress,Isolate 是架构层的事」;最后收口——「四招配好,窗口管好」——面试官点头了。我自学时把这道题练成「厨房配菜」的故事:主食打底、按单取料、剩菜回锅、分盘上菜——四招配合,一桌菜才成。

⑧( 口(诀(:

上下文四招记清楚——写得下的写,挑得出的挑——压得掉的压,分得开的分——先写后挑再压缩,隔离架构兜底牢——四招配好,窗口管好。

⑨( 三轮追问:

追问一,「Write 什么时候不够用?」——答(:三种情况——信息太大写不完(写全了窗口也爆);信息会变(写死就过期);信息是用户相关(写不进提示词)——这时换 Select 或( Compress——Write 是地基,但不是万能。面试官想听:知(道( Write 的边界,能判断什么时候换招。

追问二,「Select 的检索质量怎么保证?」——答(:三件事——召回准(向量检索加关键词,别(漏();精排准(重排模型把相关度高的排前面);过滤严(权限过滤:用户没权限的内容不注入)——检索质量是「召(回(、精(排(、过(滤(」三道关——召回保证不漏,精排保证准,过滤保证安全,缺一不可。面试官想听:知道检索链路的三道关,不只会说向量。

追问三,「Compress 摘要丢了关键信息怎么办?」——答(:三(招(——分层压(最近几轮保原文,更早的才压);关键字段保(订单号、偏(好(、承(诺(,摘要里显式保留);验证回读(压缩后拿摘要验证关键信息在不在)——「保关键、压过程、可回读」。面试官想听:知道压缩不是一刀切,有保底机制。

追问四,「Isolate 隔离怎么落地?」——答(:三个粒度——会话级(每用户每会话独立上下文);任务级(多智能体每个子任务独立上下文);内容级(系统指令区与用户输入区物理分区)——粒度选多大,看数据敏感度和任务复杂度。面试官想听:知道隔离有三个粒度,能按场景选。

追问五,「四策略怎么排优先级?」——答(:三个原则——能( Write 就(先( Write,最便宜最可靠;动态知识交给 Select,按需取用;长对话和冗余交给 Compress,窗口不够再压——Isolate 不是优化项是架构项,一开始就要设计——「先(写(、再(挑(、后(压(、隔到底」。面试官想听:知道四策略不是平级选项,有优先级和定位之分。

⑩( 加分点:

加分一,讲(「写挑压隔」四个字——一句话概括四策略——框架感立现。

加分二,讲(「先( Write 再( Select 再( Compress」——优先级排序——工程判断力。

加分三,讲(「Isolate 是架构项不是优化项」——定位清晰——架构意识加分。

加分四,讲(「三道关:召(回(、精(排(、过(滤(」——Select 的工程细节——技术理解深。

加分五,讲(「压缩要保关键字段、可回读」——Compress 的保底机制——细节扎实。

加分六,收尾升华——「四招的本质是把窗口用在刀刃上——上下文工程不是技巧,是资源管理」——一句话收尾,有洞察。

⑪( 话术库:

话术一(开(场():「上下文工程四招:Write 写(入(、Select 选(择(、Compress 压(缩(、Isolate 隔(离(——写挑压隔。」

话术二(讲( Write):「规则知识写进提示词,不靠模型猜——最便宜最可靠,能写就写。」

话术三(讲( Select):「知识库按问题检索,少而准——三道关:召(回(、精(排(、过(滤(。」

话术四(讲( Compress):「长历史压成摘要,保决策信息丢过程细节——分层压、保关键字段。」

话术五(讲( Isolate):「多任务多用户分开管,防串扰防注入——会话级、任务级、内容级三个粒度。」

话术六(收(尾():「先写再挑后压缩,隔离架构兜底牢——四招配好,窗口管好。」

⑫( 小白问答:

问题一,「Write 策略是什么?」——答(:把信息直接写进提示词——规(则(、知(识(、示(例(——不依赖模型自己知道。

问题二,「Select 策略是什么?」——答(:从外部知识库检索相关内容注入——按需取用,少而准。

问题三,「Compress 策略是什么?」——答(:把长内容压成摘要——保留关键信息,丢掉细节。

问题四,「Isolate 策略是什么?」——答(:不同任务、会(话(、用户分开管理——防串扰、防注入。

问题五,「RAG 是什么?」——答(:检索增强生成——先从知识库检索再回答——Select 策略的典型实现。

问题六,「四策略哪个最好?」——答(:没有最好的——按信息性质选——能写的写、该挑的挑、要压的压、需隔离的隔。

问题七,「Write 写越多越好吗?」——答(:不(是(——写多了挤占窗口、稀释重点——只写模型不知道且必须知道的——规则精练到每条都能执行,才是好的写入。

问题八,「为什么需要 Isolate?」——答(:两件事——串(扰((A( 任务干扰 B( 任(务()和注入(恶意内容混进指令区)。

问题九,「Compress 会丢信息吗?」——答(:可控地丢——保决策信息、丢过程细节——丢得对叫提炼。

问题十,「四策略能组合吗?」——答(:能(——实际产品几乎都是组合拳——Write 加( Select 加( Compress 加( Isolate。

问题十一,「这题面试官考什么?」——答(:考三件事——懂不懂四招(框(架()、懂不懂选择(按场景配招)、懂不懂工程(落地细节)。

问题十二,「学习四策略有什么用?」——答(:做( A(I( 产品时知道上下文怎么管理——提示词、知识库、历(史(、安全都有章法。

问题十三,「四策略和上下文窗口什么关系?」——答(:四招的本质都是把窗口用在刀刃上——写(精(、挑(准(、压(掉(、隔(开(。

问题十四,「一句话记住这题?」——答(:写挑压隔四招——写得下的写、挑得出的挑、压得掉的压、分得开的分。

⑬( 没人告诉你的事:

第一件,「面试讲这题,先亮四招框架」——「Write 写(入(、Select 选(择(、Compress 压(缩(、Isolate 隔(离(」一句话定调——面试官立刻知道你有框架,不是背术语。

第二件,「Write 是最便宜的策略」——写进提示词一次,永久生效,零检索零压缩成本——产品上线第一天,先把能写的都写了——「能写就写」是上下文工程的第一原则。

第三件,「Select 的本质是外部记忆」——模型记不住你的知识库,但检索可以让它「随时调用」——知识库运营(内容质量、更新频率)直接决定 Select 的效果——检索技术再强,库是垃圾,出来还是垃圾。

第四件,「Compress 的损失是可控的」——压缩丢的不是信息,是(「低价值信息」——决策信息(订(单(、偏(好(、承(诺()保(,过程细节(语(气(、寒(暄(、重(复()丢(——丢之前先问一句:摘要里缺了这条,用户的任务还能不能完成——「丢得对叫提炼,丢得错叫事故」。

第五件,「Isolate 是防注入的第一道墙」——用户输入「忽略指令」是常见攻击——输入与指令隔离处理,攻击就失效——安全不是补丁,是架构。

第六件,「四策略是大型模型厂商官方框架」——业界头部模型公司的上下文工程文档就是这四招——四个策略还按「先写再选再压、隔离兜底」的顺序介绍——面试时说出处,专业度直接拉满——这题不是野路子,是行业标准。

第七件,「小模型更需要 Write」——小模型隐含知识少,规则不写进去就真的不知道——Write 对小模型的提升比大模型明显——「写不写」在小模型上是生死差别。

第八件,「Select 的检索质量决定产品天花板」——同样的模型,检索准的答得准——检索链路(召(回(、精(排(、过(滤()是产品团队最值得投入的环节之一。

第九件,「Compress 要设计『回读验证』」——摘要生成后,拿摘要核对关键字段在不在——回读一次的成本很低,丢关键信息的代价很高——「压缩完不回读,等于没压缩」。

第十件,「Isolate 在多智能体架构里是标配」——多个子任务并行,各自上下文独立——不隔离就串戏:A( 任务的状态跑到 B( 任务里——智能体越复杂,隔离越重要。

第十一件,「面试答这题,讲组合拳是加分」——大部分候选人逐个背四招——你补一句「实际产品是组合拳:系统提示词加知识库加摘要加隔离」,工程认知立判。

第十二件,「Write 的工程化是提示词模板」——规则参数化(用户信息、场景变量动态填入),版本管理(改了什么有记录)——模板化之后,Write 才能规模化管理——写一次用一百次。

第十三件,「上下文预算要监控」——线上看每轮 token 消(耗(——哪招占得多但贡献低,就是优化对象——四招都是省窗口,但省得对不对,要数据说话。

第十四件,「少样本示例也是 Write 的一种」——给几个示范(输入加输出)也(是(「写进去」——示例选得好,模型照样子做——「写(」不只是规则,还有示范。

第十五件,「隔离粒度要按敏感度选」——多用户数据要会话级隔离(数据安全);多任务协作要任务级隔离(防串扰);不可信输入要内容级隔离(防注入)——粒度不是越大越好,是够用就好。

第十六件,这题的终极答案不是「背四招定义」是(「四招配好」——「写得下的写、挑得出的挑、压得掉的压、分得开的分——四招的本质是把窗口用在刀刃上」——答到这一层,面试就稳了——上下文工程的成熟,从四招配好开始。

⑭( 做一件事:

今晚做一次「四招复盘」,三个步骤:第一步,选一个你常用的智能产品(A(I( 客(服(、智能助手都行)——第二步,用四招拆它:Write:它的系统提示词写了什么规则;Select:它从哪些资料里检索;Compress:长对话它怎么处理历史;Isolate:不同会话之间隔离开了吗——第三步,写三行观察:它四招用了哪几招、哪一招做得最差、如果让你改进最差的这一招你会怎么做——写完存备忘录,下次面试讲上下文工程题直接引用。

⑮( 求职助手联系:

这(道(「上下文工程四策略」是( A(I( 产品岗的高频题,想系统练 A(I( 产品面试题、让( A(I( 当面试官追问你,微信搜 jobmate_a(i(_p(m(,备(注(「书(友(+题目编号」,给你发面试题库和练习方法——题库里有 5(0( 道( A(I( 产品高频题,每道都配了答案要点和追问,比你自己找效率高。

⑯( 练(习(:

练习一,三分钟复述「四招框架」——不看笔记讲给朋友听——答案要点:Write:规则知识写进提示词;Select:知识库按需检索;Compress:长内容压摘要;Isolate:多任务分开——收(口(——四招配好,窗口管好。

练习二,分类练习——给( 8( 个场景各判「Write、Select、Compress、Isolate 哪一招」——答案要点:退换货规则写进系统提示词→Write;用户问年假政策检索知识库→Select;3(0( 轮对话压成摘要→Compress;A( 用户会话不混 B( 用(户(→Isolate;少样本示例→Write;订单信息从数据库取→Select;会议录音转要点→Compress;多智能体子任务独立→Isolate——按四招归类。

练习三,概念辨析——说(清(「Write 和( Select 的区别」——答案要点:Write 是(「写死」固定内容进提示词,稳(定();Select 是(「现取」动态内容按需检索,会(变()——规则用 Write,资料用 Select——用反了:资料写死就过期,规则现取就不稳。

练习四,反例识别——「只要把知识库全塞进上下文,就不用管四策略」——找(出( 3( 个问题——答案要点:窗口爆满(全量塞不进,首轮就超限);噪音干扰(无关内容误导回答);成本失控(每轮都付全库的费,越用越贵)——四策略存在的意义就是把「塞(」变(成(「管(理(」。

练习五,指标设计——给(「四策略」各设计一个健康度指标——答案要点:Write:指令命中率(回答符合系统提示词的比例);Select:检索命中率(注入内容被实际引用的比例);Compress:信息保真率(压缩前后关键字段一致的比率);Isolate:隔离事故率(跨会话串扰事件次数)——四招四指标。

练习六,方案设计——设(计(「A(I( 客服的上下文方案」——答案要点:Write:客服规则、退换货政策写系统提示词;Select:商品库、售后手册按问题检索;Compress:长会话历史分轮压缩;Isolate:每用户会话独立——四招一次配齐。

练习七,追问演练——朋友当面试官问「上下文太长导致效果变差怎么办」,你完整答一遍——答案要点:先承认(上下文太长是常见问题)→按四招排查(能写的写了吗:规则挤占;该挑的挑了吗:注入太多噪音;该压的压了吗:历史原文过长)→给方案(Compress 压历史、Select 减噪音、Write 精简规则)→收(口(「上下文不是越多越好,是越对越好」——四层完整。

练习八,术语教学——给不懂技术的朋友讲懂「上下文工程」——答案要点:用厨房配菜比喻——主食打底(Write 写规则)、按单取料(Select 按需挑)、剩菜回锅(Compress 压摘要)、分盘上菜(Isolate 隔离防串味)——全程不用技术词。

练习九,场景分析——分(析(「多智能体系统为什么必须用 Isolate」——答案要点:串(扰((A( 任务状态混进 B( 任(务();注(入(一个智能体的恶意输入影响另一个);调试困难(上下文混在一起查不清)——智能体协作越密,隔离越不能省。

练习十,边界判断——说(清(「哪些内容不适合 Select 检索注入」——答案要点:三(类(——敏感数据(用户隐私,权限过滤);低质内容(知识库没运营,注入即噪音);与问题无关的(召回不准,越选越乱)——Select 的前提是库是干净的。

练习十一,行业观察——说(出( 3( 个(「上下文工程」的真实信号——答案要点:RAG 成为知识问答的主流架构(Select 工程化);长上下文模型流行但厂商仍推荐压缩摘要(Compress 必(要();多智能体框架标配独立上下文(Isolate 成标配)——四招都被行业验证。

练习十二,决策演练——「老板问:为什么我们家的 A(I( 顾问回答不如竞品?」——你怎么答——答案要点:先认同(模型是同一层)→按四招排查(Write:规则写全了吗;Select:知识库运营好吗;Compress:长对话处理对吗;Isolate:多用户串扰吗)→给方案(先查最弱一招,逐招优化)→收(口(「差距不在模型,在上下文管理」——不辩解,给路径。

练习十三,系统思考——设(计(「上下文管理体系」四(层(——答案要点:策略层(四招怎么配);内容层(规(则(、知识库、历史的组织);工程层(检(索(、摘(要(、隔离的实现);监控层(指(标(、告(警(、调(优()——四层协同,上下文才管得住。

练习十四,成本意识——列(「四策略」各自的成本——答案要点:Write:维护成本(规则更新);Select:算力加运营(检索加库维护);Compress:摘要消耗(每次压缩都调模型);Isolate:架构成本(隔离方案设计)——四招都要钱,省着用。

练习十五,复盘演讲——两分钟向朋友讲「上下文工程四策略」——答案要点:开(场(四招框架:写挑压隔)→Write:写规则不靠猜→Select:按需检索少而准→Compress:压摘要保重点→Isolate:隔任务防串扰→收(口(「四招配好,窗口管好」——六段式,时间到。

Karpathy 操作系统比喻

①( 大白话定义:

先打个比方:电脑系统(操作系统)有三大件——内(核(负责调度和计算的核心)、内(存(运行时临时存数据,快但有限,关机就清空)、磁(盘(长期存文件,慢但持久)——A(I( 大(佬( Karpathy(卡帕西,OpenAI(人工智能研究机构)联合创始人、A(I( 学(者()提(出(:大语言模型(LLM(大语言模型))就是一个「新操作系统的内核」——模型权重(训练好的参数)就是磁盘(长期记忆),上下文窗口就是内存(RAM(内(存(:运行时临时存储)),把知识写进提示词、从知识库检索、压缩历史,就是操作系统在做「内存管理」——一句话判断:用操作系统比喻讲上下文工程——「权重是磁盘,上下文是内存,上下文工程是内存管理」——比喻一讲,整张图就通了。

三十秒电梯版:Karpathy 的比喻怎么答?先亮比喻——「大语言模型是操作系统的内核」——再讲映射——权重是磁盘(长期记忆)、上下文窗口是内存(临时工作区,有限且重启丢)、检索是「把磁盘文件读进内存」按需加载)、工具调用是「系统调用」调用外部程序)、压缩是「内存交换」放不下的先腾出去)、隔离是「进程隔离」各任务各管各的)——再讲意义——「上下文工程 = 内存管理:写(、挑(、压(、隔都是管内存的招」——收(口(:把大模型当电脑系统看,上下文工程就是系统优化——比喻到位,理解就到位。

②( 为什么学:

第(一(,这是面试高频题——Karpathy 是( A(I( 圈顶流,他的比喻几乎人人引用——你也会,才不输。

第(二(,比喻是理解的最强工具——「磁盘内存内核」比(「权重上下文窗口」好懂十倍——会比喻,就是会讲道理。

第(三(,比喻背后是原理——讲清比喻,说明你真懂上下文工程的本质(有(限(、按(需(、管(理()。

第(四(,一题打通多题——这个比喻能解释上下文窗口、检(索(、压(缩(、隔(离(、工具调用——会比喻,一类题都通了。

第(五(,面试效果立竿见影——「把( A(I( 当操作系统设计」的视角,面试官印象深刻——比喻讲得好,加分实打实。

③( 原理拆解(8( 层():

第一层:内核与权重——操作系统里,内核是核心(管理硬件、调度任务);比喻里,大语言模型就是内核——模型的权重(训练好的参数)是(「磁(盘(」:知识沉淀在里面,长期有效——但磁盘上的知识「读不出来就相当于没有」——权重存的是「会什么」,上下文存的是「这次是什么」。打个比方:老员工的脑子和工位——老员工(模型内核)脑子里装着公司十年的经验(权(重(:长期记忆),但具体这单生意什么情况,得看工位上的资料(上下文)——脑(子(权重)里的经验是底子,工位上的资料(上下文)是本次任务的现场信息——两者缺一不可。

第二层:上下文窗口是内存——内(存(RAM)的特性:速度快、容量有限、断(电(会话结束)就清空——上下文窗口一模一样:模型读它飞快、装不下太多、新会话就没了——「装不下的内容」要么提前腾(压(缩()、要么去磁盘取(检(索()——内存管理(上下文工程)的全部动作,都(在(「有(限(」这两个字上展开。打个比方:电脑的内存条——内存大(窗口大)能同时开很多程序(多任务),内存满了(窗口爆)电脑就卡(效果变差)——开太多不关(上下文不清理),系统迟早崩溃(回答变差)——内(存(上下文窗口)有(限(,管理才是常态。

第三层:检索是从磁盘读文件——操作系统里,程序要用的数据从磁盘读进内存(按需加载,不全量载入);比喻里,RAG(检索增强生成)就(是(「把磁盘上的文件读进内存」——知识库是磁盘(海量长期存储),检索就是把相关文件读到上下文(内(存()——读得准(检索准),程(序(模型)干活才顺——不会用的文件不读(不相关的不注入)。打个比方:写报告前查档案——档案室(知识库)里上千份档案(海量资料),写报告(回答用户)前按主题调几份出来放桌上(检索注入上下文)——不把档案室全搬桌上(不全量注入),要哪份取哪份(按需检索)——查档员(检索系统)找得快找得准,报(告(回答)才写得快写得好。

第四层:工具调用是系统调用——操作系统里,程序想用打印机、网(络(、摄像头,不自己造,而(是(「系统调用」——申请操作系统帮忙(调用外部功能);比喻里,模型想查天气、订(票(、操作数据库,不自己算,而是调用工具(工具调用)——工具就是「外设驱动」连接外部能力的接口)——工具描述(用法说明)就(是(「驱动安装说明」。打个比方:用打印机不用自己造——程(序(模型)要打印文件,不自己实现打印机(不自己算天气),调用系统接口(工具调用)让打印机干活(调用天气服务)——接口说明(工具描述)写得清楚,程(序(模型)才知道怎么用——好的操作系统(好的工具设计),外设即插即用(工具即调即用)。

第五层:压缩是内存交换——操作系统内存不够时,把暂时不用的数据换到磁盘(内存交换/换(页(),要用时再换回来;比喻里,长对话的历史压成摘要,就(是(「把不用的细节换到『磁盘』丢掉细节只留要点),留出内存(窗(口()给当前任务」——交(换(压缩)保的是「关键信息」、腾的是「当前空间」——没有交换(压(缩(),内(存(窗口)早就爆了。打个比方:书桌清空术——桌(子(窗口)堆满书(上下文),做作业(当前任务)没地方——把旧书收回书架(历史压成摘要存到磁盘),桌上只留作业本(当前任务)——要用旧书(查历史)再回书架取(读摘要)——清理书桌(压(缩()不是扔书,是腾地方。

第六层:隔离是进程隔离——操作系统里,每个程序是一个进程,各有各的内存空间(进程隔离):A( 程序崩了不影响 B(,A( 的数据 B( 看不到;比喻里,不同用户、不同任务的上下文要隔离——A( 用户的订单信息不出现在 B( 用户的对话里(数据隔离),一个任务的上下文不干扰另一个(任务隔离)——隔离是「防串扰、防泄密」的机制。打个比方:银行的柜台窗口——每个窗口(进(程()服务一个客户(会(话(),A( 窗口的客户资料(上下文)不会出现在 B( 窗(口(隔离)——一个窗口出问题(一个任务出错),不影响其他窗口(隔离容错)——柜台隔离(进程隔离)让银行(系(统()安全不乱。

第七层:系统提示词是系统配置——操作系统有配置文件(开机启动哪些服务、系统参数设多少);比喻里,系统提示词就是「内核配置」——角色设定(启动什么服务)、规则约束(参数限制)、输出格式(输出协议)——配置稳定(每次开机都按配置来),程(序(对话)行为就稳定——改配置(改系统提示词)影响所有新程序(新会话),所以配置要谨慎。打个比方:餐厅的开店准备——开(店(新会话)前定好菜单和服务规范(系统提示词:角(色(、规(则(、格(式(),所有客人(用(户()都按这套标准服务(每次请求都生效)——改菜单(改系统提示词)影响所有客人(全局生效),所以要审慎——标准定得好(配置好),服务就稳(回答就稳)。

第八层:产品经理的视角——把( A(I( 产品当操作系统设计——「进程管理」对应会话管理(每个对话是一个进程)、「内存管理」对应上下文工程(写挑压隔)、「磁盘管理」对应知识库运营(内容质量与更新)、「外设管理」对应工具集成(第三方系统接入)——产品迭代就是「系统优化」:哪里卡(响应慢)优化哪里(延(迟()、哪里崩(效果差)修哪里(上下文)——比喻的终点是系统思维。打个比方:系统管理员的一天——看进程(会(话()有没有异常、看内存(上下文)有没有爆、看磁盘(知识库)有没有脏数据、看外设(工(具()有没有失联——系统管理员(A(I( 产品经理)的日常,就是系统优化——把( A(I( 当系统管,产品才立得住。

④( 对比表格:

A(I( 概(念(操作系统概念特(性(管理动作
模型权重磁(盘(长(期(、持(久(知识运营
上下文窗口内(存(有(限(、易(失(写挑压隔
检索注入磁盘读文件按需加载检索优化
工具调用系统调用调用外部工具管理
历史压缩内存交换腾空间摘要策略
多任务隔离进程隔离防串扰隔离设计


读这张表记住一行:权重是磁盘、上下文是内存、检索是读文件、工具是系统调用——把( A(I( 当电脑系统看,管理就清楚了。

⑤( 例(子(:

例(一(:磁盘例——模型训练完,知识存在权重里(磁(盘()——问(「二战是哪年结束的」,模型从权重(磁(盘()直接答——长期记忆,不用检索。

例(二(:内存例——用户说「刚才说的那个餐厅」——「那个餐厅」在上下文(内(存()里(,模型读内存才知道——内(存(上下文)没(存(,模型就不知道。

例(三(:检索例——用户问「公司年假政策」——系统从知识库(磁(盘()检索政策文件读到上下文(内(存()——按需读文件,不读全库。

例(四(:系统调用例——用户说「帮我订明天的高铁票」——模型调用订票工具(系统调用),工具去外部系统执行——模型不自己造订票功能。

例(五(:内存交换例——3(0( 轮对话后窗口快满——系统把前 2(0( 轮压成摘要(换到磁盘),留出空间给当前对话——关键信息在,细节丢了。

例(六(:进程隔离例——一个助手同时服务 100 个用户——每个用户的对话(进(程()独立内存——A( 用户的信息不串到 B( 用(户(。

例(七(:系统配置例——客服机器人系统提示词「你是客服,语气友好」——每次会话(开(机()都按配置(系统提示词)启(动(——配置稳定,行为稳定。

例(八(:系统优化例——产品响应慢(内存管理差:上下文塞太多)——优化检索(少注入)、加压缩(腾空间)——系统管理员(产品经理)出(手(,系(统(产品)流畅了。

⑥( 常见误区:

误区一,「比喻就是讲故事,不解决问题」——不(对(——比喻背后是原理映射(有(限(、按(需(、隔(离(、管(理()——用比喻推导解决方案,才叫会用比喻。

误区二,「上下文窗口越大越好,内存无限就不用管理」——不(对(——内(存(窗口)再大也有限,而且越大越贵越慢——管(理(写挑压隔)永远必要。

误区三,「检索就是全量读盘」——不(对(——系统读文件是按需读,检索是相关才注入——全量读盘(全量注入)是内存爆炸(窗口爆)的根源。

误区四,「工具调用越多越好」——不(对(——外设接得越多,系统越乱(驱动冲突、调用出错)——按需接、最小化——工具贵精不贵多。

误区五,「压缩就是丢数据」——不(对(——内存交换(压(缩()保关键腾空间,是系统正常机制——不会压才叫丢,会压叫优化。

误区六,「隔离是系统管理员的事」——不(对(——隔离是产品设计的一部分(多用户数据安全、多任务防串扰)——产品经理不设计隔离,事故就等着你。

误区七,「比喻只是面试技巧」——不(对(——把( A(I( 当系统设计(进(程(、内(存(、磁(盘(、外设管理)是真实的产品方法论——比喻不是话术,是思维框架。

⑦( 第一人称:

我(是( 2(7( 岁被裁后自学转行 A(I( 产品的,面(试( A(I( 应用岗时被问过这道题。我的回答是:先亮比喻——「Karpathy 说大语言模型是操作系统的内核,我认同——权重是磁盘、上下文是内存、检索是读文件、工具是系统调用」;再讲管理——「既然上下文是内存,上下文工程就是内存管理——写(把配置写进系统)、挑(按需读文件)、压(内存交换腾空间)、隔(进程隔离防串扰)」;再讲产品——「把( A(I( 产品当操作系统设计:进程管理对应会话、内存管理对应上下文、磁盘管理对应知识库、外设管理对应工具」;最后收口——「比喻不是讲故事,是系统思维」——面试官点头了。我自学时把这道题练成「电脑系统管理员」的故事:管内存、管磁盘、管外设、管进程——系统管得好,产品跑得稳。

⑧( 口(诀(:

操作系统比喻记清楚——权重磁盘上下文内存——检索读文件工具系统调用——压缩是交换隔离是进程——写挑压隔管内存,会话知识工具分系统管——比喻讲清原理通,上下文工程全打通。

⑨( 三轮追问:

追问一,「为什么说上下文窗口像内存不像硬盘?」——答(:三个共同点——容量有限(内存小、窗口有限);读写快(内存比硬盘快、上下文比检索快);易(失(断电丢、会话结束丢)——而硬盘(权(重()持久但慢——「有(限(、快(、易(失(」三个特性都指向内存。面试官想听:知道比喻要落到特性上,不是贴标签。

追问二,「检索和内存交换怎么配合?」——答(:两条路径——检索是「缺什么补什么」从磁盘读相关文件进内存);交换是「什么不用的腾出去」把旧数据压到磁盘留空间)——配合用:先按需读(检(索(),再腾空间(压(缩()——「进(检索)出(压缩)管理好,内(存(窗口)不(爆(」。面试官想听:知道两个动作的配合关系,不只会单独说。

追问三,「工具调用在比喻里为什么是系统调用?」——答(:两个共同点——自己不做、调接口(程序不自己造打印机,模型不自己算天气);按描述使用(系统调用按接口规范,工具按工具描述)——把工具设计成「即插即用」的外设,模(型(系统)扩展能力——「不造轮子,调轮子」。面试官想听:知道工具调用的本质是「接外部能力」,懂设计要点。

追问四,「这个比喻还能解释什么?」——答(:三个延伸——多智能体是「多进程协作」各进程各内存、通信靠消息);长任务是「进程状态保存恢复」任务中断后恢复上下文);知识库更新是「磁盘文件替换」改了文件,下次读就是新的)——比喻的延伸性证明它是原理级框架。面试官想听:知道比喻能延伸,说明真懂原理。

追问五,「比喻的边界在哪?」——答(:三个不能硬套——模型不像操作系统那样可精确调度(输出有随机性);上下文不是真实内存(没有地址、不能随机访问);权重不是真磁盘(不能直接读写,只能通过训练改)——「比喻是帮助理解,不是物理等价」。面试官想听:知道比喻的边界,不滥用——这个反思是加分项。

⑩( 加分点:

加分一,讲(「权重是磁盘、上下文是内存」——一句比喻定调——比直接讲概念好懂。

加分二,讲(「内存管理四招:写挑压隔」——把上下文工程和比喻打通——理解深。

加分三,讲(「有(限(、快(、易(失(」三个特性——比喻落到特性,不是贴标签——严(谨(。

加分四,讲(「检索是读文件、压缩是内存交换」——两个概念对应清楚——映射完整。

加分五,讲(「多进程协作对应多智能体」——比喻延伸——思维开阔。

加分六,收尾升华——「比喻不是讲故事,是系统思维——把( A(I( 当操作系统设计,产品才立得住」——一句话收尾,有洞察。

⑪( 话术库:

话术一(开(场():「Karpathy 的比喻:大语言模型是操作系统的内核——权重是磁盘,上下文是内存。」

话术二(讲内存):「上下文窗口像内存:有(限(、快(、易(失(——会话结束就清空——所以上下文要管理。」

话术三(讲检索):「检索是磁盘读文件:按需加载,相关才读——不全量搬进内存。」

话术四(讲工具):「工具调用是系统调用:不造轮子,调接口——按工具描述即插即用。」

话术五(讲管理):「压缩是内存交换,隔离是进程隔离——上下文工程就是内存管理:写挑压隔。」

话术六(收(尾():「把( A(I( 当操作系统设计:进程对应会话、内存对应上下文、磁盘对应知识库、外设对应工具——比喻是系统思维。」

⑫( 小白问答:

问题一,「Karpathy 是(谁(?」——答(:A(I( 领域的大佬,OpenAI 联合创始人——他提出用操作系统比喻理解大语言模型。

问题二,「模型权重是什么?」——答(:模型训练好的参数——知识存在里面——像磁盘,长期有效。

问题三,「上下文窗口像什么?」——答(:像内存(RAM)——容量有限、读写快、会话结束就清空。

问题四,「检索像什么?」——答(:像从磁盘读文件——按需加载相关内容,不全量读。

问题五,「工具调用像什么?」——答(:像系统调用——程序不自己造打印机,模型不自己算天气——调外部接口。

问题六,「压缩历史像什么?」——答(:像内存交换——放不下的旧数据腾到磁盘,留空间给当前任务。

问题七,「隔离像什么?」——答(:像进程隔离——各任务各内存,不串扰不泄密。

问题八,「系统提示词像什么?」——答(:像系统配置——每次会话按配置启动,稳定不漂。

问题九,「为什么说上下文要管理?」——答(:内(存(窗口)有(限(——不管理就爆——管理就是写挑压隔。

问题十,「比喻有边界吗?」——答(:有(——模型不可精确调度、上下文不是真内存——比喻帮助理解,不是物理等价。

问题十一,「这题面试官考什么?」——答(:考三件事——懂不懂比喻(映射完整)、懂不懂原理(特性分析)、懂不懂边界(不滥用)。

问题十二,「比喻能延伸吗?」——答(:能(——多智能体像多进程协作、长任务像进程恢复——延伸证明框架是真的。

问题十三,「为什么比喻是加分项?」——答(:比喻把复杂讲简单,还体现理解深度——面试官一听就懂,印象深刻。

问题十四,「一句话记住这题?」——答(:权重是磁盘、上下文是内存——上下文工程就是内存管理,写挑压隔四招。

⑬( 没人告诉你的事:

第一件,「面试讲这题,先亮比喻再讲映射」——「大语言模型是操作系统内核」一句话开场——再逐个映射(磁盘内存读文件系统调用)——比喻开场,全程高能。

第二件,「比喻的威力在『好(懂(』」——面试官也是人——「权重是磁盘、上下文是内存」比(「参数空间、上下文窗口」好懂十倍——讲得让人听懂,比讲得深更值钱。

第三件,「『有(限(』是比喻的题眼」——内存为什么需要管理?因为有限——上下文工程的一切动作(写挑压隔)都在回答「内存有限怎么办」——抓(住(「有(限(」两个字,整题就有了魂。

第四件,「检索对应用例要讲『按(需(』」——不(是(「检(索(」两个字——是(「磁盘按需读文件,不全量载入」——「按(需(」才是和内存管理呼应的关键词。

第五件,「压缩的比喻要讲『腾空间』」——内存交换的语义是「腾出空间给当前任务」——不(是(「丢历史」——「腾(」字讲出来,压缩的正当性就立住了。

第六件,「隔离的比喻要讲两层」——进程隔离防串扰(任务不干扰)加防泄密(数据不可见)——两层都讲,才完整——只讲一层,面试官会觉得浅。

第七件,「Karpathy 的名字要会拼」——首字母大写、拼写正确——面试现场拼错名字,比不会比喻还尴尬——「名字是对大佬的尊重」。

第八件,「比喻的边界是加分点」——大部分候选人只会背比喻——你补一句「比喻不是物理等价,模型不可精确调度、上下文不是真内存」,思考深度立判——知道边界,才叫真懂。

第九件,「这个比喻能延伸」——多智能体像多进程协作、长任务像进程状态保存恢复——延伸讲得出来,证明框架在你脑子里活了——「会延伸的比喻,才是你的」。

第十件,「内存管理四招呼应上一题」——写挑压隔(上下文工程四大策略)正好是「内存管理四招」——两题打通着答,面试官会记住你——「比喻题和策略题,是同一张图」。

第十一件,「面试答这题,讲产品视角是加分」——把( A(I( 产品当操作系统设计(进(程(、内(存(、磁(盘(、外设管理)——大部分候选人停在比喻本身——你多讲一层产品视角,格局立现。

第十二件,「比喻要用来推导方案」——不(是(「讲讲比喻就完」——用比喻推方案:内存爆了怎么办(压缩交换)、读文件慢怎么办(检索优化)——比喻是指南针,不是装饰品。

第十三件,「真实产品里比喻是工作语言」——团队讨论上下文问题时说「内存满了」「读盘慢」——比喻是团队沟通的压缩格式——「一个比喻,省十分钟解释」。

第十四件,「别把比喻讲成段子」——比喻是帮助理解的结构,不是抖机灵——每个映射都要能回到技术原理——「讲段子是及格线,讲原理才是高分线」。

第十五件,「系统管理员视角要落地」——产品经理的比喻式日常:看会话(进(程()有没有异常、看上下文(内(存()有没有爆、看知识库(磁(盘()有没有脏数据、看工具(外(设()有没有失联——比喻落到工作流,才不是空谈。

第十六件,这题的终极答案不是「背比喻」是(「用比喻」——「权重是磁盘、上下文是内存——上下文工程就是内存管理:写挑压隔——把( A(I( 当操作系统设计,产品才立得住」——答到这一层,面试就稳了——比喻的成熟,从会用开始。

⑭( 做一件事:

今晚做一次「操作系统视角复盘」,三个步骤:第一步,选一个你常用的智能产品(A(I( 客(服(、智能助手都行)——第二步,用系统管理员视角检查它:内(存(它的上下文怎么管理的:检索准吗、历史压了吗)、磁(盘(它的知识库更新勤吗)、外(设(它的工具接了几个、用得好吗)、进(程(多用户隔离了吗)——第三步,写三行观察:它哪个「子系统」最(弱(、最弱的这个怎么改、改完你会怎么验证——写完存备忘录,下次面试讲这题直接引用。

⑮( 求职助手联系:

这(道(「Karpathy 操作系统比喻」是( A(I( 产品岗的高频题,想系统练 A(I( 产品面试题、让( A(I( 当面试官追问你,微信搜 jobmate_a(i(_p(m(,备(注(「书(友(+题目编号」,给你发面试题库和练习方法——题库里有 5(0( 道( A(I( 产品高频题,每道都配了答案要点和追问,比你自己找效率高。

⑯( 练(习(:

练习一,三分钟复述「核心比喻」——不看笔记讲给朋友听——答案要点:权重是磁盘(长期记忆);上下文是内存(有限快易失);检索是读文件(按需加载);工具是系统调用(调外部接口)——收(口(——上下文工程就是内存管理。

练习二,映射练习——给( 8( 个( A(I( 概念各找出「操作系统对应物」——答案要点:模型权重→磁(盘(;上下文窗口→内(存(;知识库检索→磁盘读文件;工具调用→系统调用;历史压缩→内存交换;多用户隔离→进程隔离;系统提示词→系统配置;对话会话→进(程(——一一映射。

练习三,概念辨析——说(清(「权重和上下文的区别」——答案要点:权重是长期记忆(磁(盘(,持(久(,训练时写);上下文是临时工作区(内(存(,易(失(,会话时读)——权重决定「会什么」,上下文决定「这次是什么」——两者缺一不可。

练习四,反例识别——「上下文窗口够大,就不需要内存管理」——找(出( 3( 个问题——答案要点:成(本(窗口越大越贵);速(度(越大越慢);效(果(噪音上下文稀释重点)——内存再大也要管理,「够用且管好」胜(过(「大而无当」。

练习五,指标设计——给(「A(I( 系统的内存健康度」设计三个指标——答案要点:上下文占用率(当前窗口用了多少);检索命中率(注入内容被引用的比例);压缩保真率(压缩前后关键字段一致的比率)——三指标对应内存管理三动作。

练习六,方案设计——设(计(「A(I( 客服的内存管理方案」——答案要点:内存规划(系统提示词固定占用、检索内容按需注入、历史分轮压缩);内存监控(占用率告警);内存清理(低价值内容定期清理)——像管理电脑内存一样管上下文。

练习七,追问演练——朋友当面试官问「上下文窗口爆了怎么办」,你完整答一遍——答案要点:先承认(内存有限是常态)→按比喻拆(先压缩:内存交换腾空间;再检索优化:少读文件;最后隔离检查:是不是串了别的进程)→给方案(写挑压隔四招按序排查)→收(口(「内存管理四招,招招是腾空间」——四层完整。

练习八,术语教学——给不懂技术的朋友讲懂「什么是上下文工程」——答案要点:用电脑系统比喻——上下文是内存、知识库是磁盘、写挑压隔是内存管理——「把( A(I( 当电脑系统管」——全程不用技术词。

练习九,场景分析——分(析(「为什么多用户产品必须做进程隔离」——答案要点:防泄密(A( 用户数据不能被 B( 看(到();防串扰(A( 的任务状态不干扰 B();防事故扩散(一个会话出问题不崩全系统)——进程隔离是产品的安全底线。

练习十,边界判断——说(清(「比喻哪些地方不能硬套」——答案要点:三(类(——模型输出有随机性(系统调用是确定的);上下文没有地址(内存可随机访问);权重不能直接读写(磁盘可直接改文件)——比喻帮助理解,不是物理等价。

练习十一,行业观察——说(出( 3( 个(「操作系统化」的真实信号——答案要点:工具调用成为模型标准能力(外设管理);多智能体框架兴起(多进程协作);RAG 成为主流架构(磁盘读文件)——比喻正在变成现实架构。

练习十二,决策演练——「老板问:为什么同样的模型,我们家的回答不如竞品?」——你怎么答——答案要点:先认同(模型内核一样)→按系统排查(内(存(:上下文管理好吗;磁(盘(:知识库运营好吗;外(设(:工具接得好吗;进(程(:隔离到位吗)→给方案(先修最弱子系统)→收(口(「内核一样,系统优化不一样——差距在管理」——不辩解,给路径。

练习十三,系统思考——设(计(「A(I( 系统管理员的工作清单」四(块(——答案要点:内存管理(上下文占用监控、压缩策略);磁盘管理(知识库更新、质量检查);外设管理(工具清单、调用日志);进程管理(会话监控、隔离验证)——四块齐备,系统不崩。

练习十四,成本意识——列(「操作系统比喻」对应的三块成本——答案要点:内存成本(上下文 token 消(耗();磁盘成本(知识库存储与维护);外设成本(工具接入与调用)——成本意识用比喻一样讲得清。

练习十五,复盘演讲——两分钟向朋友讲「Karpathy 的操作系统比喻」——答案要点:开(场(内核比喻)→磁盘内存(权重与上下文)→读文件系统调用(检索与工具)→交换隔离(压缩与隔离)→收(口(「上下文工程就是内存管理,写挑压隔」——五段式,时间到。

上下文三大类别

①( 大白话定义:

先打个比方:给新来的实习生(大模型)安排工作,要交代三类东西——第一类「怎么做」:按这个流程干、注意格式、不许乱来(指导性上下文);第二类「知道什么」:这是项目资料、这是客户情况、这是历史数据(信息性上下文);第三类「能做什么」:你有这些工具可以用、出了问题可以找谁、可以调用哪些系统(行动性上下文)——给大模型(LLM(大语言模型))的上下文也分这三类:指导性上下文告诉模型「怎么做事」系统提示词、规(则(、输出格式、少样本示例);信息性上下文给模型「知识和事实」文档、数(据(、检索到的资料、用户输入);行动性上下文告诉模型「能调用什么」工具清单、API(应用程序接口)定(义(、可执行的操作)——一句话判断:三类上下文分别是「怎么做、知道什么、能做什么」——把三类分清楚,提示词设计就有了骨架。

三十秒电梯版:上下文三大类别怎么讲?先讲分类——指导性(怎么做):系统提示词、角色设定、规则约束、输出格式、少样本示例;信息性(知道什么):背景资料、用户输入、检索结果、历史对话;行动性(能做什么):工具定义、可用操作、权限边界——再讲管理——指导性放系统提示词(稳定不丢)、信息性按需注入(控制上下文窗口)、行动性定义在工具层(按需启用)——再讲预算——三类都要占上下文窗口,要分配和裁剪——收(口(:三类各司其职,分得清才用得对。

②( 为什么学:

第(一(,上下文工程是大模型应用面试的高频题——考你懂不懂提示词和上下文的组织。

第(二(,「三类上下文」框架一句话讲清提示词的结构——答出来就是框架感。

第(三(,产品落地离不开三类上下文——RAG(检索增强生成)是信息性、工具调用是行动性、系统提示词是指导性——三类是产品设计的骨架。

第(四(,上下文窗口是稀缺资源——三类怎么分配、怎么裁剪,直接决定产品效果和成本。

第(五(,一通百通——「怎么做、知道什么、能做什么」的分类适用于一切智能体设计——会一个题,通一类题——把三类框架记住,提示词和智能体类面试题都能接住。

③( 原理拆解(8( 层():

第一层:指导性上下文——告诉模型「怎么做」——系统提示词(角(色(、行为规范、价值观)、任务指令(本次任务做什么)、规则约束(不许编造、输(出( JSON(一种结构化数据格式))、少样本示例(给几个示范,让模型照样子做)——指导性上下文的特征:不是事实,是(「行为准则」。打个比方:给员工的员工手册——员工手册(系统提示词)写的是行为规范:怎么接待客户(角色设定)、什么话不能说(规则约束)、报表格式什么样(输出格式)——手册不是业务资料(信息性),是(「怎么做事的准则」——手册稳定不换,业务资料随时更新。

第二层:信息性上下文——给模型「知识和事实」——用户输入(本次请求)、背景资料(项目文档、产品说明)、检索结果(从知识库检索到的相关内容)、历史对话(前几轮聊了什么)——信息性上下文的特征:是(「事实和内容」,不(是(「做(法(」。打个比方:给员工的项目资料——做方案前,把客户情况、历史数据、参考案例(信息性上下文)递给员工——员工手册(指导性)教他怎么做,项目资料(信息性)告诉他做什么——资料越全,方案越准——资料过期(上下文过时),方案就跑偏。

第三层:行动性上下文——告诉模型「能做什么」——工具清单(有哪些工具可用:查天气、订(票(、搜(索()、工具的定义(每个工具的用途和参数)、可执行的操作(能调用哪些系统:下(单(、发消息)、权限边界(哪些操作不能做)——行动性上下文的特征:是(「能力和边界」,让模型从「说(」到(「做(」。打个比方:给员工的工具箱和权限——工具箱(工具清单):有锤子、螺丝刀(工具定义:用途和用法);权限卡(权限边界):能进仓库(可执行操作)、不能进财务室(禁止操作)——只有手册(指导性)和资料(信息性),没有工具(行动性),员工只能「纸上谈兵」。

第四层:三类上下文的分工配合——指导性定「怎么做」语气、格(式(、规(则()、信息性定「答什么」内容、事(实(、依(据()、行动性定「能做什么」工具、动(作(、边(界()——三者配合,模型才从「会聊天」变(「能干活」。打个比方:餐厅的三本册子——服务规范(指导性:怎么说话、怎么上菜)、菜谱和食材(信息性:有什么菜、什么料)、后厨和吧台的钥匙(行动性:能进哪、能调什么)——三本册子(三类上下文)齐(了(,服务员(模(型()才能把一餐(任(务()做(好(。

第五层:上下文的注入位置——指导性放系统提示词(每次请求都带上、稳定优先);信息性按需注入(每次请求根据本次内容动态拼装,控制长度);行动性定义在工具层(模型可见的工具描述,按需启用)——位置决定优先级和成本。打个比方:办公室的三种摆设——员工手册放桌上(系统提示词:天天可见、固定不变);项目资料按项目分文件夹(信息性:做哪个项目拿哪个);工具间钥匙挂在特定办公室(工具定义:要用时去取)——摆设位置(注入位置)决定使用效率——手册放抽屉里(指导性被截断),员工就忘了规矩。

第六层:上下文窗口预算——三类上下文共用同一个上下文窗口——指导性(系统提示词)长期占用、信息性(用户输入加检索)随请求变化、行动性(工具描述)按启用多少计——窗口满了,最先被裁剪的是「最不重要的信息」——产品要设计「优先级裁剪」策(略(。打个比方:行李箱打包——行(李(上下文窗口)只有这么多空间——洗漱包(系统提示词)必须带(长期占用)、衣(服(信息性)按行程带(按需注入)、工(具(工具定义)挑用得上的带(按需启用)——塞不下时先扔「用不上的纪念品」低价值上下文)——打包策略(裁剪策略)决定行李箱(窗(口()装不装得下。

第七层:三类上下文的管理要点——指导性:稳(定(、简(短(、更新要谨慎(规则改了要全局生效);信息性:及(时(检索要新)、相(关(检索要准)、可溯源(模型要能引用出处);行动性:最小权限(只给需要的工具)、安(全(工具调用要校验、敏感操作要确认)——每类有每类的管理重点。打个比方:三个仓库的管理员——手册管理员(指导性):版本要统一(规则一致)、改版要发全员(更新全局生效);资料管理员(信息性):资料要新(及(时()、分类要对(相(关()、贴来源标签(可溯源);工具管理员(行动性):只发能干的活(最小权限)、贵重工具登记(安全校验)——三个管理员(三类管理)各管一摊,仓(库(系统)不(乱(。

第八层:产品经理的视角——三类上下文对应三种产品能力——指导性对应「产品规则配置」后台可配系统提示词)、信息性对应「知识库与检索」RAG 做得好不好)、行动性对应「工具与集成」能接多少第三方系统)——产品迭代就是三类上下文的持续优化——三类想清楚,产品架构就清楚了。打个比方:餐厅的三种竞争力——服务规范(指导性:培训体系)决定稳定;食材供应链(信息性:数据质量)决定口味;后厨设备(行动性:工具集成)决定效率——餐(厅(AI 产(品()的竞争力,是三类能力的总和。

④( 对比表格:

类(别(回答的问题典型内容注入位置
指导性怎么做系统提示词、规(则(、格(式(、少样本示例系统提示词(稳(定()
信息性知道什么用户输入、资(料(、检索结果、历(史(按需注入(动(态()
行动性能做什么工具清单、工具定义、权限边界工具层(按需启用)


读这张表记住一行:指导性定怎么做、信息性定答什么、行动性定能做什么——三类各司其职,分得清才用得对。

⑤( 例(子(:

例(一(:系统提示词例——客服机器人系统提示词写「你是客服,语气友好,回答不超过三句」——每次对话都生效——指导性上下文。

例(二(:RAG 检索例——用户问「公司年假政策」,系统从知识库检索政策文档注入上下文——信息性上下文。

例(三(:工具调用例——用户说「帮我查明天的天气」,模型看到天气工具的调用定义,调用接口拿数据——行动性上下文。

例(四(:少样本示例例——让模型把评论转成 JSON 格(式(,给两个「输入加正确输出」的示例——模型照样子输出——指导性上下文。

例(五(:历史对话例——「刚才说的那个餐厅」——模型读前几轮对话才知道「那个餐厅」指什么——信息性上下文。

例(六(:权限边界例——工具定义里注明「查询余额只读、转账需要二次确认」——模型知道什么能做什么不能做——行动性上下文。

例(七(:上下文裁剪例——长对话窗口快满,系统把「最早的闲聊轮次」压缩成摘要——保留关键事实,丢弃寒暄——信息性上下文的管理。

例(八(:三类配合例——「你是财务助手(指导性),公司报销政策是……信息性),你可以调用报销系统提交申请(行动性)」——三类齐备,一次完整任务。

⑥( 常见误区:

误区一,「上下文就是用户说的话」——不(对(——上下文是三类:指导性(规(则()、信息性(事(实()、行动性(工(具()——只把用户输入当上下文,产品就缺骨架。

误区二,「提示词越长越细越好」——不(对(——过长会挤占窗口、稀释重点——指导性要精简,信息性要相关——「够用就好」胜(过(「面面俱到」。

误区三,「少样本示例是万能的」——不(对(——示例会引入示例的偏差(模型模仿示例的错误)——示例要精挑,错误示例是毒药。

误区四,「检索结果越多越好」——不(对(——检索注入过多噪音上下文,模型反而不准——检索要「少而准」,不(是(「多而全」。

误区五,「工具给得越多越强」——不(对(——工具过多会分心(模型纠结选哪个工具)、增加错误调用风险——最小权限,够用就好。

误区六,「上下文更新不重要」——不(对(——过时的信息性上下文会给出错误答案(引用旧政策)——检索要新、资料要及时更新。

误区七,「三类上下文可以混着放」——不(对(——指导性放系统提示词、信息性按需注入、行动性放工具层——混放会导致管理混乱和成本失控。

⑦( 第一人称:

我(是( 2(7( 岁被裁后自学转行 A(I( 产品的,面(试( A(I( 应用岗时被问过这道题。我的回答是:先亮框架——「上下文三类:怎么做(指导性)、知道什么(信息性)、能做什么(行动性)」;再逐个讲——「指导性放系统提示词:角(色(、规(则(、格(式(、少样本示例;信息性按需注入:用户输入、检索结果、历史对话;行动性定义在工具层:工具清单、权限边界」;再讲管理——「窗口是稀缺资源,三类要分配和裁剪」;最后收口——「三类各司其职,分得清才用得对」——面试官点头了。我自学时把这道题练成「实习生三件套」的故事:员工手册、项目资料、工具箱——三样给齐,实习生才能干活。

⑧( 口(诀(:

上下文三类记清楚——指导性定怎么做,信息性定知道啥——行动性定能干啥,三类各司其职——系统提示词放规则,检索注入按需来——工具定义最小权,窗口预算要裁剪。

⑨( 三轮追问:

追问一,「系统提示词怎么写才稳定?」——答(:三个原则——简(短(能少则少,留空间给信息性)、明(确(规则不含糊,每条可执行)、版本化(改版要记录,避免规则漂移)——系统提示词是「地(基(」,写一次用很久,要(稳(。面试官想听:知道系统提示词要稳定可维护,不是越长越好。

追问二,「信息性上下文怎么控制质量?」——答(:三件事——检索要准(语义检索加重排,别把无关内容注入);时效要新(资料过期会答错);可溯源(回答要能引用出处,用户可验证)——「准(、新(、可溯源」,信息性上下文的三条命。面试官想听:知道信息性上下文的质量标准。

追问三,「窗口满了怎么办?」——答(:三层策略——裁(剪(低价值内容先丢:寒(暄(、重(复();压(缩(把长历史压成摘要,保留关键事实);分(层(当前任务完整、更早的用摘要代替)——「先裁剪、再压缩、最后分层」。面试官想听:知道窗口管理的三层策略,不只会删。

追问四,「工具定义要注意什么?」——答(:三个注意——描述清晰(模型靠描述决定调不调用,写清用途和参数);最小权限(只给当前场景需要的工具);安全校验(敏感操作二次确认、调用日志记录)——工具定义是行动性的「说明书」,写好才不出乱子。面试官想听:知道工具定义的工程和安全细节。

追问五,「三类上下文怎么平衡预算?」——答(:按价值分配——指导性(稳定价值高)优先保证;信息性(本次任务相关)按需注入;行动性(工具描述)按启用场景计——定期看「哪类上下文占比高但贡献低」,优化它——预算是动态的,平衡是持续的事。面试官想听:知道三类上下文的预算平衡是持续优化。

⑩( 加分点:

加分一,讲(「怎么做、知道什么、能做什么」——三句话概括三类——框架感立现。

加分二,讲(「注入位置决定优先级」——系统提示词稳定、信息性动态、工具按需——工程理解深。

加分三,讲(「窗口是稀缺资源」——三类共用窗口,要分配裁剪——资源意识加分。

加分四,讲(「准(、新(、可溯源」——信息性上下文的质量标准——方法论成熟。

加分五,讲(「最小权限」——工具定义的安全原则——安全意识加分。

加分六,收尾升华——「三类上下文对应三种产品能力:规则配置、知识库、工具集成——产品迭代就是三类上下文的持续优化」——一句话收尾,有洞察。

⑪( 话术库:

话术一(开(场():「上下文三类:指导性定怎么做,信息性定答什么,行动性定能做什么。」

话术二(讲指导性):「系统提示词:角(色(、规(则(、输出格式、少样本示例——稳定优先,写一次用很久。」

话术三(讲信息性):「用户输入、检索结果、历史对话——按需注入,准(、新(、可溯源。」

话术四(讲行动性):「工具清单、工具定义、权限边界——定义在工具层,最小权限够用就好。」

话术五(讲管理):「窗口是稀缺资源——先裁剪、再压缩、最后分层——三类分配要平衡。」

话术六(收(尾():「三类各司其职,分得清才用得对——产品迭代,就是三类上下文的持续优化。」

⑫( 小白问答:

问题一,「什么是上下文?」——答(:模型回答问题时要「看(到(」的全部输入——包括规则、资(料(、历(史(、工具定义。

问题二,「指导性上下文是什么?」——答(:告诉模型怎么做的——系统提示词、规(则(、格(式(、少样本示例。

问题三,「信息性上下文是什么?」——答(:给模型的事实和内容——用户输入、资(料(、检索结果、历史对话。

问题四,「行动性上下文是什么?」——答(:告诉模型能做什么——工具清单、工具定义、权限边界。

问题五,「少样本示例是什么?」——答(:给几个「输入加正确输出」的示范,让模型照样子做——属于指导性。

问题六,「RAG 是什么?」——答(:检索增强生成——先从知识库检索相关内容,再注入上下文让模型回答——信息性上下文的典型应用。

问题七,「系统提示词放哪里?」——答(:系统提示词层——每次请求都带上,稳定不丢。

问题八,「历史对话算哪类?」——答(:信息性——前几轮的事实和内容,帮助理解「那(个(」指什么。

问题九,「工具定义算哪类?」——答(:行动性——告诉模型能调用什么、怎么调、边界在哪。

问题十,「窗口满了怎么办?」——答(:先裁剪、再压缩、最后分层——低价值内容先丢。

问题十一,「检索越多越好吗?」——答(:不(是(——多而全不如少而准——噪音上下文会干扰回答。

问题十二,「这题面试官考什么?」——答(:考三件事——懂不懂分类(三类框架)、懂不懂管理(注入和预算)、懂不懂产品(三类对应三种能力)。

问题十三,「三类上下文能混着放吗?」——答(:不建议——各有各的位置——混放导致管理混乱和成本失控。

问题十四,「一句话记住这题?」——答(:怎么做(指导性)、知道什么(信息性)、能做什么(行动性)——三类各司其职,分得清才用得对。

⑬( 没人告诉你的事:

第一件,「面试讲这题,先亮三类框架」——「怎么做(指导性)、知道什么(信息性)、能做什么(行动性)」一句话定调——面试官立刻知道你有框架,不是背术语。

第二件,「三类英文名也要会」——指导性 instructive、信息性 informative、行动性 actionable——面试官可能随口问英文——中英文对得上,专业度立现。

第三件,「系统提示词是沉默的稳定器」——用户看不见它,但每次请求都生效——规则写得好不好,影响每一次回答——它是最便宜的投资(写一次用很久),也是最贵的疏忽(写错全错)。

第四件,「信息性上下文是产品差异化的主战场」——同样的模型,检索质量不同,答案质量天差地别——知识库整理、检索优化,是产品团队最能使劲的地方。

第五件,「工具定义写得好不好,模型一试就知道」——描述模糊的工具(「有个查询功能」),模型不知道何时调用——工具描述要写清:用(途(、参(数(、什么时候用、什么时候不用。

第六件,「上下文窗口不是越大越好」——越大越贵(token(令(牌(,计费最小单位)成本高)、越(慢(推理变慢)——把窗口塞满不是本事,用得省是本事。

第七件,「少样本示例是双刃剑」——选得好的示例是「学习的榜样」,选得差的示例是「带偏的毒药」——示例必须精挑:正(确(、典(型(、无歧义。

第八件,「信息性占比过高会稀释规则」——上下文里全是资料,系统提示词的规则被淹没——回答就「有知识没规矩」——每轮注入要控制比例。

第九件,「权限边界是安全的第一道门」——工具调用要校验(参数合法吗)、敏感操作要确认(转账要二次确认)、日志要记录(出了事查得清)——行动性上下文管不好,产品越强越危险。

第十件,「多轮历史也是信息性,也要裁剪」——用户说了 5(0( 轮(,全塞进去是噪声——最近几轮原文、更早的压缩成摘要——历史管理是信息性上下文的隐形工程。

第十一件,「面试答这题,讲三类对应三种产品能力是加分」——「指导性对应规则配置、信息性对应知识库、行动性对应工具集成」——大部分候选人只讲分类,你多讲一层产品视角,深度立判。

第十二件,「提示词改版要有版本管理」——系统提示词改了一版,行为就变了——改了什么、为什么改、怎么回滚,都要记录——规则漂移是团队协作的隐形事故。

第十三件,「信息性上下文的时效是隐形杀手」——知识库半年没更新,模型一本正经答旧政策——「更新机制」要写进产品规划,不是想起来才更。

第十四件,「行动性上下文是智能体的发动机」——工具越多,智能体越强,但越难控(选择困难、调用出错)——智能体产品的迭代,就是行动性上下文的精细化——少而精,胜过多而乱。

第十五件,「上下文预算是要监控的指标」——线上跑起来,要看每轮请求的 token 消(耗(——哪类上下文占比高但贡献低,就是优化对象——预算管理是持续的事,不是上线前的事。

第十六件,这题的终极答案不是「背三类定义」是(「三类各司其职」——「指导性定怎么做、信息性定答什么、行动性定能做什么——分得清才用得对」——答到这一层,面试就稳了——上下文的成熟,从分得清三类开始。

⑭( 做一件事:

今晚做一次「三类上下文复盘」,三个步骤:第一步,选一个你常用的智能产品(A(I( 客(服(、智能助手、推荐应用都行)——第二步,拆它的三类上下文:指导性(它按什么规则回答你:语(气(、格(式(、限(制()、信息性(它(「知(道(」什(么(:产品资料、你的历史、搜索内容)、行动性(它能做什么:查订单、改设置、调接口)——第三步,写三行观察:它哪类上下文做得最好、哪类最差、如果让你改进最差的这一类你会怎么做——写完存备忘录,下次面试讲上下文题直接引用。

⑮( 求职助手联系:

这(道(「上下文三大类别」是( A(I( 产品岗的高频题,想系统练 A(I( 产品面试题、让( A(I( 当面试官追问你,微信搜 jobmate_a(i(_p(m(,备(注(「书(友(+题目编号」,给你发面试题库和练习方法——题库里有 5(0( 道( A(I( 产品高频题,每道都配了答案要点和追问,比你自己找效率高。

⑯( 练(习(:

练习一,三分钟复述「三类框架」——不看笔记讲给朋友听——答案要点:指导性(怎么做:系统提示词、规(则(、格(式(、少样本示例);信息性(知道什么:用户输入、检(索(、历(史();行动性(能做什么:工具清单、权限边界)——收(口(——三类各司其职,分得清才用得对。

练习二,分类练习——给( 8( 个例子各判「指导性、信息性、行动性哪一类」——答案要点:系统提示词写「你是客服」→指导性;知识库检索的政策文档→信息性;天气工具的调用定义→行动性;少样本示例→指导性;用户的历史对话→信息性;转账需要二次确认→行动性;「回答不超过三句」的规则→指导性;后台的订单数据→信息性——按三类归类。

练习三,概念辨析——说(清(「指导性上下文和信息性上下文的区别」——答案要点:指导性是「怎么做」行为准则,稳(定();信息性是「答什么」事实内容,动(态()——规则是手册,资料是项目——混了就会「有知识没规矩」或(「有规矩没内容」。

练习四,反例识别——「把全部资料都塞进上下文,模型就能答好」——找(出( 3( 个问题——答案要点:窗口爆满(成本高、推理慢);规则被稀释(指导性被信息性淹没);噪声干扰(无关资料误导回答)——信息性要「少而准」,不(是(「多而全」。

练习五,指标设计——给(「三类上下文的健康度」设计三个指标——答案要点:指导性(规则命中率:回答符合系统提示词要求的比例);信息性(检索命中率:注入内容被回答实际引用的比例);行动性(工具调用成功率:工具被正确调用的比例)——三类各配一指标。

练习六,方案设计——设(计(「A(I( 客服的系统提示词」——答案要点:角(色(你是客服,语气友好);规(则(不编造、不承诺超出权限的事);格(式(回答不超过三句);示(例(给一个标准问答示范)——四段式,精简可执行。

练习七,追问演练——朋友当面试官问「上下文窗口满了怎么办」,你完整答一遍——答案要点:先承认(窗口是稀缺资源)→讲三层策略(先裁剪:丢寒暄低价值;再压缩:长历史压摘要;最后分层:当前完整、更早摘要)→讲预防(控制检索注入量、限制工具描述)→收(口(「先裁剪、再压缩、最后分层」——四层完整。

练习八,术语教学——给不懂技术的朋友讲懂「上下文是什么」——答案要点:用实习生三件套比喻——员工手册(指导性:怎么做)、项目资料(信息性:知道什么)、工具箱和权限(行动性:能做什么)——三样给齐,实习生才能干活——全程不用技术词。

练习九,场景分析——分(析(「A(I( 客服产品的三类上下文分别怎么设计」——答案要点:指导性(客服规则:语(气(、权(限(、转人工条件);信息性(商品库、售后政策、用户订单);行动性(查订单、改地址、发起退款)——三类配齐,客服才能「干(活(」不(止(「聊(天(」。

练习十,边界判断——说(清(「哪些信息不适合放进上下文」——答案要点:三(类(——敏感数据(身份证、密(码(,隐私风险);低频无效内容(几年前的闲聊);与任务无关的资料(噪(声()——上下文不是仓库,是(「本次任务的工作台」。

练习十一,行业观察——说(出( 3( 个(「上下文工程」的真实信号——答案要点:RAG 成为主流架构(信息性上下文的工程化);工具调用(function calling)普(及(行动性上下文的标准件);提示词和上下文管理平台兴起(指导性上下文的产品化)——三类上下文都在被工程化。

练习十二,决策演练——「老板问:为什么同样的模型,我们家的回答不如竞品?」——你怎么答——答案要点:先认同(模型是同一层)→讲三类(竞品的指导性规则更细、信息性检索更准、行动性工具更全)→讲排查(先测哪类上下文最弱:规则命中、检索命中、工具调用)→给方案(优先优化最弱的一类)→收(口(「模型一样,上下文不一样——差距在三类上下文上」——不辩解,给路径。

练习十三,系统思考——设(计(「上下文管理体系」三(层(——答案要点:定义层(三类怎么分、放(哪();工程层(检(索(、注(入(、裁(剪(、压缩的机制);监控层(token 消(耗(、命中率、质量指标)——三层协同,上下文才管得住。

练习十四,成本意识——列(「上下文」三块成本——答案要点:token 成(本(窗口越大越贵);推理成本(窗口越大越慢);维护成本(知识库更新、提示词版本管理)——三块成本是「少而准」的底层理由。

练习十五,复盘演讲——两分钟向朋友讲「上下文三大类别」——答案要点:开(场(三类框架:怎么做、知道什么、能做什么)→指导性(系统提示词稳定优先)→信息性(按需注入准新可溯源)→行动性(工具定义最小权限)→收(口(「三类各司其职,分得清才用得对」——五段式,时间到。

薪资谈判要点

①( 大白话定义:

先打个比方:去餐厅点套餐,只看招牌价(月薪一个数)会吃亏——套餐里到底有几道菜(发几个月)、有没有隐藏加价(奖金波动)、送不送饮品(福(利()、给不给会员卡(股票期权),都要翻开菜单(薪酬结构)看仔细——谈薪也是这样:不是谈「月(薪(」一个数,是(谈(「总包结构」——总包等于五块:固定部分(月薪基数、发几个月:1(3( 薪( 1(5( 薪( 1(2( 薪()、浮动部分(绩效奖金基数、浮动范围、发放节奏)、福(利(公积金比例、社保基数、补(贴()、长期激励(股票期权的授予数量、归属期、行权条件)、涨薪机制(每年普调吗、晋升加薪多少)——一句话判断:谈薪的本质是「把口头承诺变成写进 offer(录用通知)的结构」——问得越细,吃亏越少。

三十秒电梯版:薪资谈判怎么谈?先问清五块——固(定(月薪多少、发几个月、1(3( 薪( 1(5( 薪哪几个月是确定的);浮(动(奖金基数多少、0( 到( 2( 倍怎么浮动、按季度还是年度发、上一年平均发了多少);福(利(公积金按 5(% 7(% 1(2(% 哪个比例、社保基数按实际工资还是最低档、有没有餐补交通补贴);长期激励(股票期权给多少、按什么价格算、分几年归属、离职怎么算);涨(薪(每年普调吗、晋升加多少)——再谈总包(固定加浮动加福利加长期),不单盯月薪——每项都确认「写(进( offer」,口头承诺会变。

②( 为什么学:

第(一(,谈薪是求职最后一关——前面答得再好,谈薪谈亏了等于白干——总包差几万,够加好几个月班。

第(二(,「薪酬结构清单」是谈薪基本功——五块拆清楚,不露怯不踩坑——面试问「你有什么问题吗」,问薪酬结构是最稳的问题。

第(三(,H(R(人力资源)给的数字背后全是规则——1(3( 薪里几个月是确定的、奖金有没有保底、期权按什么价格算——规则不懂,数字就是空话。

第(四(,长期激励是「第二张 offer」——股票期权做得好,几年后价值可能超过工资——授(予(、归(属(、行权三件事要全懂。

第(五(,一通百通——薪酬结构框架适用于一切谈薪场景(校(招(、跳(槽(、涨薪谈判同理)——会一个题,通一类题——把(「总包五块」记(住(,所有谈薪场合都能接住——框架不挑场合,总包意识随身带。

③( 原理拆解(8( 层():

第一层:固定部分的门道——月薪基数(税前税后要问清)加发几个月(1(2( 薪( 1(3( 薪( 1(5( 薪()——1(5( 薪等于 1(2( 加( 3(年终 3( 个(月()——关键问法:几个月是「确定的」写进合同),几个月是「看绩效的」——有的公司 1(5( 薪(里( 3( 个月是全有,有的只是「目标值」。打个比方:点套餐看单点价——套(餐(总包)标(价( 300,但菜单小字写着「含两道例牌菜」确定的 1(2( 薪()——例(牌(确定的月份)比招牌(宣传的总薪数)重(要(——先(问(「确定的有几个月」,再(问(「宣传的总薪数」——确定的部分才是兜底。

第二层:浮动部分的规则——绩效奖金:基数多少(是月薪的 1( 倍还是 2( 倍()、浮动范围(0( 到( 2( 倍(?有没有保底)、发放节奏(季度还是年度)——经典问法:「上一年平均发放水平是多少」——平均发放水平比「理论上限」值(钱(——上限是画饼,平均水平是现实。打个比方:开盲盒和问平均——盲(盒(奖金)可能开出一倍可能开出零点二倍——聪明的买家先问「别人平均开出多少」上一年平均发放水平),再决定期望值——平均水平是历史事实,上限只是营销话术。

第三层:福利的隐性价值——公积金比例(5(% 7(% 1(2(% 每月差不少:月薪两万,5(% 缴一千,1(2(% 缴两千四,单边每月差一千四,两边差两千八)、社保基数(按实际工资还是最低档,直接决定养老金和医保额度)、补(贴(餐补交通补房补)——福利不写在月薪里,但每个月都在发生。打个比方:看不见的月供——两套房标价一样,一套物业费低(公积金高)一套物业费高(公积金低)——月(供(月支出)不一样——福利就是「每月的隐性差额」,看(房(谈薪)时要算进总账。

第四层:长期激励的授予——股票期权的授予数量、按什么价格算(行权价)、占总股本的比例——口头说「给(你( X( 万(股(」要问清:这个数占总盘子多少(占比比股数值钱)——占比决定你分享公司增长的比例。打个比方:饼要问清楚多大——老板说「给你一块饼」X 万(股()——不问饼总共多大(总股本)、不问你这块占多少(占(比(),光(看(「一(块(」没意义——公司涨十倍,你的这块跟着涨多少,取决于占比,不取决于块头。

第五层:归属期与悬崖期——常见四年归属(四(年( vesting 分批到账),一年悬崖期(干满一年才拿第一笔,没满一年一分没有)、之后按季度或按月归属——问(法(:「归属节奏怎么走,离职怎么算」——归属期越长,你越要问清离职条件。打个比方:分期到账的奖学金——说好四年给你一百万,但(要(「每学期考及格才发」归属条件)——第一学期没及格(没干满一年悬崖期),一分钱没有——奖学金(期(权()是(「到账才算数」的(,合同上写清楚节奏。

第六层:行权条件——拿到归属的股票后,行权价多少(按发行价还是现价)、离职后多久内必须行权(窗口期)、行权要不要交税(期权行权有税务规则)——行权是「把纸面股权变成钱」的最后一步,条件不看清,股权是纸。打个比方:兑换券的使用规则——兑换券(期(权()到账了(归属了),但小字写着「节假日不可用」行权窗口限制)、「兑换要另补差价」行权价)、「过期作废」离职窗口期)——券是纸还是钱,看使用规则。

第七层:谈判策略——先问清结构再谈总包——别一上来只盯月薪——顺(序(:先让对方讲清五块(固定浮动福利长期涨薪),再(谈(「总包要多少」——每谈定一项,都确认「写(进( offer 吗(」——口头承诺不写下来,等于没有——还要判断对方的弹性:大厂的职级带宽相对透明,创业公司的期权空间更大——先看清对方的结构,再定自己的打法。打个比方:先看全菜单再点单——点(菜(谈薪)先翻完整本菜单(问清五块结构),再决定点什么(谈总包)——只盯着招牌菜(月(薪()点(,结(账((签( offer)时才发现套餐里全是隐形消费(福利差别、奖金波动)。

第八层:产品经理的视角——谈薪也是「信息不对称博弈」——你对规则懂得越多,议价能力越强——把薪酬当产品拆解:固定是保底收益、浮动是风险收益、福利是隐性收益、长期激励是期权收益——不同风险偏好的候选人有不同的最优组合——有人要现金(保底优先)、有人要期权(赌成长)——想清楚自己「要什么组合」,再去谈。打个比方:点菜配荤素——要现金(保底优先)像点主食,赌期权(赌成长)像加菜——按自己的风险口味配菜,才能吃得饱又吃得好。

④( 对比表格:

薪酬项要问清的问题为什么重要
固定月薪税前还是税后,发几个月兜底收入,确定的才是真的
1(3( 薪( 1(5( 薪(几个月写进合同,几个月看绩效宣传口径不等于确定收入
绩效奖金基数多少,浮动范围,上一年平均水平平均水平比上限值钱
公积金社保比例多少,基数按什么标准每月隐性差额,两边可差几千
股票期权数量多少,按什么价,占比多少占比比股数值钱
归属行权分几年归属,离职怎么算,行权价到账才算数,规则决定价值


读这张表记住一行:总包五块——固定浮动福利长期加涨薪——问得越细,吃亏越少——每项都确认写进 offer。

⑤( 例(子(:

例(一(:1(5( 薪拆解例——H(R( 说(「1(5( 薪(」——追问后发现:1(2( 加( 3(,其(中( 3( 个月是绩效目标值——去年平均发 1( 个(月(——实际总包比宣传少两个月。

例(二(:公积金差额例——两家公司月薪都是两万——一家公积金 1(2(%,一(家( 5(%——每月两边差两千八,一年差三万三——福利差距等于一个多月工资。

例(三(:奖金浮动例——H(R( 说(「奖(金( 0( 到( 3( 个(月(」——追(问(「上一年平均发多少」——答案是 1(.5( 个(月(——按平均算总包,不按上限算。

例(四(:期权占比例——H(R( 说(「给( 1(0( 万(股(」——追问总股本——占比只有万分之零点五——稀释后价值有限——占比比股数重要。

例(五(:悬崖期例——期权四年归属、一年悬崖——入职第十一个月离职——期权一分没拿到——干满一年才有第一笔——所以入职前先算好最短留任时间,再决定要不要把期权算进总包。

例(六(:行权价例——行权价每股十元,离职后三个月内必须行权——市场价只有八元——行权反而亏——行权条件要先看。

例(七(:社保基数例——公司按最低基数交社保,月薪两万只按五千交——养老金和医保待遇都缩水——基数按实际工资还是最低档,直接影响未来。

例(八(:涨薪机制例——合同只写月薪,没写调薪——入职后发现两年没普调——涨薪机制(每年普调、晋升加薪)要问在 offer 前(。

⑥( 常见误区:

误区一,「只盯月薪一个数」——不(对(——总包五块,月薪只是一块——别(让( H(R( 把注意力都引到月薪上。

误区二,「不好意思问奖金平均水平」——错(——奖金本来就是绩效相关,问(「上一年平均水平」是正常信息——不问才亏。

误区三,「口头说给多少就当是多少」——不(行(——口头承诺会变——每项谈定都确认「写(进( offer」——口头是空气,合同是法律。

误区四,「期权按股数算价值」——不(对(——股数没有占比和行权价就是空数——先问占比和行权价,再算价值。

误区五,「入职后再谈涨薪」——危(险(——入职定下的基数决定后续涨幅——基数谈不上去,涨薪百分比再高也有限——谈薪的最佳时机是 offer 前(。

误区六,「福利不重要」——不(对(——公积金社保补贴每月都在发生,一年差几万——福利也是钱,要算进总包。

误区七,「总包谈好就结束了」——不(是(——确认每项写进 offer、看清合同细节(社保基数、期权条款)——谈完还要验完。

⑦( 第一人称:

我(是( 2(7( 岁被裁后自学转行 A(I( 产品的,面试谈薪时把这道题用上了。我的做法是:先讲框架——「总包五块:固(定(、浮(动(、福(利(、长期激励、涨薪机制」;再逐项问——「1(3( 薪( 1(5( 薪哪几个月确定?奖金上一年平均发多少?公积金按什么比例?期权按什么价、占多少?每年有普调吗?」;再谈总包——「把五块加起来报一个数,不单盯月薪」;最后确认——「每谈定一项都请 H(R( 写(进( offer」——结果我拿到了比第一次报价高两成的总包。我自学时把这道题练成「点套餐」的故事:先翻完整本菜单,再决定点什么。

⑧( 口(诀(:

谈薪五块记清楚——固定浮动福利加长期——月薪基数问税前,几个月确定要问清——奖金问平均,不按上限算——公积金比例差几千,社保基数按实际——期权问占比和行权价,归属行权看条款——总包一起谈,每项写 offer。

⑨( 三轮追问:

追问一,「H(R( 说( 1(5( 薪(,怎么确认?」——答(:拆成两个问题——「几个月是写进合同的,几个月是绩效目标值?」加(「上一年 1(5( 薪实际平均发到多少?」——确定性加历史事实,两个数据一拼,真实总包就出来了。面试官想听:知道把宣传口径拆成确定部分和浮动部分。

追问二,「股票期权怎么问才专业?」——答(:四个问题——给多少股(数(量()、按什么价格(行权价)、占总股本多少(占(比()、分几年归属、离职怎么算(归属和退出条款)——数量加价格加占比加归属,四问下来期权就是透明的。面试官想听:知道期权的完整评估维度。

追问三,「奖金和总包怎么平衡?」——答(:先分开算——保底总包(固定加福利)加期望总包(固定加奖金平均)加上限总包(固定加奖金上限)——用三个数对比 offer,不被一个数字牵着走——谈的时候按期望值谈,心里有保底和上限。面试官想听:知道用多个口径评估 offer。

追问四,「H(R( 说不能透露平均奖金怎么办?」——答(:不硬问——换问法:「那按你们的目标值和市场惯例,这个岗位的期望总包大概在什么范围?」——拿目标值和市场数据算期望,再(用(「行业内同岗总包大概在什么区间」锚(定(——实在问不到,就用招聘网站的行情区间兜底——信息越全,谈得越稳——问法是艺术,信息拿得到就行。面试官想听:知道问不出的信息怎么绕过去。

追问五,「谈薪最该守住的一条是什么?」——答(:确定性——确定的部分(固定加写进合同的月份)守底线,浮动和期权当惊喜——所有口头承诺都要书面确认——「谈薪谈的是结构,守的是确定性」。面试官想听:知道谈薪的核心是确定性,不是数字游戏——数字可以浮动,规则不能含糊——规则清楚了,数字自然谈得拢。

⑩( 加分点:

加分一,讲(「总包五块」框(架(——固定浮动福利长期加涨薪——框架感立现。

加分二,讲(「上一年平均发放水平」——用历史事实替代宣传上限——专业问法。

加分三,讲(「占比比股数值钱」——期权评估的关键洞察。

加分四,讲(「三个总包口径」——保底期望上限——决策方法成熟。

加分五,讲(「口头承诺会变,写(进( offer 才(算(」——风险意识加分。

加分六,收尾升华——「谈薪不是讨价还价,是信息博弈——你对薪酬规则懂得越多,议价能力越强——结构清楚了,数字自然会谈」——一句话收尾,有洞察。

⑪( 话术库:

话术一(开(场():「先了解一下薪酬结构——总包大概分几块,固定和浮动怎么配?」

话术二(问固定):「1(3( 薪( 1(5( 薪(里(,哪几个月是写进合同的,哪几个月是绩效目标值?」

话术三(问浮动):「绩效奖金的基数是多少?上一年这个岗位平均发放水平大概是多少?」

话术四(问福利):「公积金按多少比例交?社保基数按实际工资还是按最低档?」

话术五(问期权):「期权给多少股、按什么价格、占总股本多少?分几年归属、离职怎么算?」

话术六(收(尾():「整体看下来,期望总包在这个范围——各项都确认写进 offer 的(话(,很有诚意加入。」

⑫( 小白问答:

问题一,「1(2( 薪( 1(3( 薪( 1(5( 薪什么意思?」——答(:一年发 1(2( 个月工资,1(3( 薪多发 1( 个(月(,1(5( 薪多发 3( 个(月(——关键是问清几个月确定、几个月看绩效。

问题二,「总包是什么?」——答(:固定加浮动加福利加长期激励加涨薪预期——别只盯月薪一个数。

问题三,「奖金怎么问?」——答(:问基数、问浮动范围、问发放节奏、问上一年平均水平——平均水平比上限值钱。

问题四,「公积金比例重要吗?」——答(:重(要(——5(% 和( 1(2(% 每月两边差几千,一年差几万——比例和基数都要问。

问题五,「社保基数是什么?」——答(:交社保的基数——按实际工资交还是按最低档交,决定养老金和医保待遇。

问题六,「期权和股票有什么区别?」——答(:期权是「未来按约定价买股票的权利」,股票直接给——期权要看行权价和归属条件。

问题七,「归属期是什么意思?」——答(:分几年分批到账——常见四年归属、一年悬崖期——没满一年离职一分没有。

问题八,「行权是什么?」——答(:把期权按行权价换成股票——要看行权价、离职窗口期、税务规则。

问题九,「口头承诺算数吗?」——答(:不(算(——口头会变——每项谈定都确认写进 offer。

问题十,「什么时候谈薪最合适?」——答(:offer 前(——入职后基数定了,再谈就难了——基数决定后续涨幅。

问题十一,「H(R( 不说平均奖金怎么办?」——答(:换问法——问目标值、问市场惯例、问期望总包范围——绕过去也能拿到信息。

问题十二,「这题面试官考什么?」——答(:考三件事——懂不懂结构(总包五块)、会不会问(问法专业)、守不守得住(确定性和书面确认)。

问题十三,「福利算钱吗?」——答(:算(——公积金社保补贴每月都在发生——一年差几万很正常。

问题十四,「一句话记住这题?」——答(:总包五块问清楚,确定的部分守底线,每项写进 offer——谈薪谈的是结构,守的是确定性。

⑬( 没人告诉你的事:

第一件,「谈薪的最佳时机是 offer 前(」——入职后基数定了,再谈就难了——offer 前的每一轮沟通都是谈判窗口——窗口期过了,主动权就没了。

第二件,「H(R( 和你的目标不是对立的」——H(R( 的任务是「用合适的价格把人招进来」,你的任务是「拿到合适的价格」——双方都有预算空间,谈得专业反而加分——专业谈薪者,H(R( 也尊重。

第三件,「开口价会影响整个谈判」——报价太高吓跑对方,太低亏了自己——用(「期望总包范围」报(价(给区间不给死数),给自己留空间——范围报价是谈薪的常用技巧——报价前先算好三个数:保(底(、期(望(、上(限(——上限喊太高直接出局,保底喊太低开局就亏。

第四件,「base(固定月薪)比( bonus(奖(金()值(钱(」——固定部分是合同保障,奖金是看绩效的——两(个( offer 总包一样,选( base 高(的(——固定打底,浮动当惊喜。

第五件,「期权是期望不是现金」——期权价值要打折扣看——行权价、归属期、公司前景、稀(释(,全折完才是真实价值——期权按「可能值」算(,现金按「确定值」算(。

第六件,「面试答这题,讲(『确定性优先』是加分」——大部分候选人讲「要更多钱」——你补一句「确定的部分守底线,浮动和期权当惊喜」,成熟度立判——谈薪谈的是结构,不是数字游戏。

第七件,「薪酬结构问题也是面试题」——面试官问「你有什么问题吗」,问薪酬结构是最稳的问题——显示你专业、理(性(、有规划——问得好,加分不扣分。

第八件,「同岗不同薪很正常」——别拿同事的工资和自己比——谈薪只和自己要的目标比——比较是内耗,谈判是争取。

第九件,「福利差距藏在大头后面」——公积金社保差距一年几万,比涨薪百分比还多——先算福利,再谈月薪——隐性收入先算清,显性数字才好谈——算福利要算双边:公司缴的那部分也是你的钱——两边加起来,才是真实差距。

第十件,「离职谈判也是谈薪」——离职时谈的补偿、期权行权窗口、竞业协议,都是薪酬结构的一部分——入职谈一次,离职还要谈一次——结构框架两头都用得上——离职谈的是补偿基数、竞业范围和期权处理——同一套结构,两种场景。

第十一件,「书(面( offer 前的口头承诺要复查」——H(R( 口头说的和 offer 写的可能有出入——收(到( offer 逐项核对:月(薪(、奖(金(、公积金、期(权(、涨薪机制——写错的概率不高,但出了就是大损失——逐项核对花十分钟,省的是之后几年的烦心。

第十二件,「行情价是谈薪的底气」——面试前查同岗同城的薪资范围(招聘网站、面(经()——有行情价在手,报价不心虚——信息是谈判力的核心。

第十三件,「谈薪不是只有钱」——试用期时长、年假天数、远程办公、培训机会,都是可谈项——总包里钱的权重高,但其他条件也值钱——谈判桌比想象的大。

第十四件,「新公司期权税要提前问」——期权行权涉及的税务规则不同国家和地区不一样——行权价、窗口期、税(负(,入职前问清——税务问题不问,到账时后悔。

第十五件,「涨薪机制决定你的长期总包」——一年普调 5(% 和两年不涨,长期差出一大截——合同里没有涨薪条款的,谈薪时问「晋升加薪怎么走」——短期总包重要,长期曲线更重要。

第十六件,这题的终极答案不是「多要钱」是(「结构清楚」——「总包五块问清楚,确定的部分守底线,浮动和期权当惊喜,每项写进 offer」——答到这一层,面试就稳了——谈薪的成熟,从想清楚结构开始。

⑭( 做一件事:

今晚做一次「总包测算练习」,三个步骤:第一步,把你现在或目标岗位的薪酬列成五块——固(定(月薪多少、发几个月)、浮(动(奖金怎么算)、福(利(公积金社保补贴)、长(期(有没有股票期权)、涨(薪(普调机制)——第二步,算出三个总包数:保底总包(固定加福利)、期望总包(固定加奖金平均)、上限总包(固定加奖金上限)——第三步,写三行观察:你现在的总包在哪一档、哪一块最弱、下次谈薪先补哪一块——写完存备忘录,下次谈薪直接引用。

⑮( 求职助手联系:

这(道(「薪资谈判要点」是求职通关心态题,想系统练 A(I( 产品面试题、让( A(I( 当面试官追问你,微信搜 jobmate_a(i(_p(m(,备(注(「书(友(+题目编号」,给你发面试题库和练习方法——题库里有 5(0( 道( A(I( 产品高频题,每道都配了答案要点和追问,比你自己找效率高。

⑯( 练(习(:

练习一,三分钟复述「总包五块」——不看笔记讲给朋友听——答案要点:固(定(月薪加月份数);浮(动(奖金基数加平均水平);福(利(公积金社保补贴);长(期(股票期权);涨(薪(普调机制)——收(口(——谈薪谈的是结构,守的是确定性。

练习二,分类练习——给( 8( 个说法各判「固(定(、浮(动(、福(利(、长(期(、涨薪哪一类」——答案要点:月薪两万→固(定(;年终奖三个月→浮(动(;公积金 1(2(%→福(利(;期权十万股→长(期(;社保按实际工资→福(利(;奖金上一年平均 1(.5( 个(月(→浮(动(;每年普调→涨薪机制;行权价每股十元→长(期(——按薪酬类别归类。

练习三,概念辨析——说(清(「固定部分和浮动部分的区别」——答案要点:固定是合同保障(确定到账);浮动是绩效相关(看表现和公司)——固定打底,浮动当惊喜——谈判时先锚定固定。

练习四,反例识别——「月薪给得高,其他不用问」——找(出( 3( 个问题——答案要点:月份数(1(5( 薪是宣传还是确定);公积金社保(福利差距一年几万);期权条款(口头股数没有行权价和占比就是空话)——月薪只是总包一块。

练习五,指标设计——给(「评估一个 offer」设计评估维度——答案要点:确定性(固定部分占比、写进合同的比例);总(包(保底期望上限三档);长(期(期权占比归属行权);风(险(公司前景、行业周期、试用期)——四维交叉评估。

练习六,方案设计——设(计(「和( H(R( 谈薪的沟通方案」——答案要点:开(场(感谢加表达意愿);问结构(五块逐项问清);报范围(期望总包范围);守底线(确定的部分);收(尾(确认写进 offer)——五步话术,步步有目的。

练习七,追问演练——朋友当面试官问「H(R( 说(:这个岗位预算就这么多」,你完整答一遍——答案要点:先不慌(预算不等于上限)→换角度(问福利和期权的空间)→讲总包(不只月薪,总包范围可以谈)→讲价值(自己匹配度加分项)→收(口(「谈的是总包结构,不是单个月薪」——五层完整。

练习八,术语教学——给不懂技术的朋友讲懂「薪酬结构」——答案要点:用点套餐比喻——套餐价(总(包()里有主食(固(定()、例(牌(月份数)、加(购(奖金)、饮(品(福利)、会员卡(期(权()——全程不用术语。

练习九,场景分析——分(析(「为什么 offer 前是谈薪最佳时机」——答案要点:谈判筹码(公司已经选中,替换成本高);心理窗口(双方都想成交);规则未定(offer 内容可以谈)——入职后筹码消失,规则已定。

练习十,边界判断——说(清(「哪些情况期权不值得要」——答案要点:三(类(——公司前景不明(价值难兑现);归属期过长(离职就拿不到);行权价过高(涨了才值钱)——期权是期望,别把期望当现金。

练习十一,行业观察——说(出( 3( 个(「薪酬谈判」的真实信号——答案要点:招聘要求写「薪资面议」的岗位谈判空间大;市场下行时现金为王、期权让位;大厂薪酬倒挂(新人比老人高)催生频繁跳槽谈薪——行情影响谈判策略。

练习十二,决策演练——「两(个( offer:A( 月薪高奖金浮动大,B( 月薪低福利期权好」——你怎么选——答案要点:先算保底总包(A( 和( B( 的固定加福利)→再算期望总包(加奖金平均水平)→看风险偏好(要现金选 A(,赌成长选 B()→看长期曲线(涨薪机制和期权)→收(口(「选( offer 是选风险组合,不是选数字」——不只看月薪,看结构——还要算试用期:试用期打八折还是全额、时长多久、转正有没有调薪——试用期也是总包的一部分,别漏算。

练习十三,系统思考——设(计(「谈薪准备体系」三(层(——答案要点:信息层(行情价、岗位定位、公司预算);结构层(总包五块、三个口径);策略层(报价范围、底(线(、替代方案)——三层备齐,谈薪不慌。

练习十四,成本意识——列(「谈薪谈亏」三块隐性成本——答案要点:基数成本(基数低,后续涨薪全受影响);福利成本(公积金社保差距年化几万);机会成本(入职后发现可谈项没谈,再谈要等窗口)——谈亏一次,亏好几年。

练习十五,复盘演讲——两分钟向朋友讲「薪资谈判怎么谈」——答案要点:开(场(总包五块)→固(定(月薪加月份数)→浮(动(奖金问平均)→福利期权(隐性收入)→收(口(「谈的是结构,守的是确定性,每项写进 offer」——五段式,时间到。

← 上一章☰ 目录下一章 →
📝 我的备忘录

不认识的蓝色词、不会答的紫色题,点一下就收进来。
两类分开存:词是拿来查的,题是拿来练的。
📌 正文点一下任意一段,或点词/题弹卡里的「先放着」= 暂存待看。

💬 不懂就问
备忘录管存(收藏不会的词和题),这里管问——复制书上任何看不懂的字句粘贴进来,它用大白话讲给你听。
提问后关掉面板也能继续跑,答完了右下角💬会亮红点提醒你。
你好呀,我是你的面试陪练老师👋

书里哪句话看不懂、哪个词不认识、哪道题不知道怎么答,直接粘贴进来问我。我会用大白话讲,讲完还会告诉你怎么在面试里用。

举个例子:粘贴「RAG是检索增强生成…」,问:这句话是什么意思?面试官为什么问这个?
🎤 语音面试
点击🎤开始语音面试
⚙ 设置(AI能力三连 / 我的情况 / 同步)
自动模式按 Gemini → GPT → GLM → DeepSeek 顺序自动选可用模型;选中大模型后只走该模型;千问-VL 专用于看图片,无需配置。价格已卡死:所有模型 ≤ 输入2元/输出4元每百万token

AI 每次对话都会带上这段「我的情况」(改完立即生效);留空 = 用默认设定

✅ 永久同步已开启:…
电脑和手机打开同一网址即自动同步,无需绑定
🤖 智能 = 它自己判断:简单问题不思考直接答;问天气/新闻/行情自动联网;闲聊日常自动切日常口吻。
🗂 对话记录