让 AI 自己去面试
AI 播客 · 项目实测记录 · 单人旁白

让 AI 自己去面试

一个 AI 面试自动化项目的真实踩坑录音:虚拟声卡、ASR、知识库、守卫系统,每一期都是一次线上事故换来的判断。

18已上线期数
4.7总时长(小时)
15:46单集平均时长
1506滚动字幕总条数

全部 18 期

第一季 · 18 期 · 单人旁白 · 点击卡片进入收听页
EP01把三个系统焊成一个闭环15:58
这件事的难点不在流程编排,而在把声音从一个不可编程的物理世界,接到一个必须完全相信它的第三方平台上。
期号2026-10-07§1开场§2三个系统,缺一不可§3为什么不能想当然§4声音走的那两条路
EP02声音不经过空气:虚拟声卡双线闭环15:39
要让声音精准送达,唯一的办法是让它不经过空气;虚拟声卡就是一根纯软件的数字转接线,而它带来的最大好处,是我们终于找到了一个不会被界面骗到的判据。
期号2026-10-07§1开场§2为什么声音一离开软件就失控了§3虚拟声卡:播放进一头,另一头就变成麦克风§4让浏览器交出麦克风
EP03单线与双线:一次取舍换来 85 个百分点15:59
这 85 个百分点不是靠换模型、调提示词换来的,全部收益来自两件事:把物理接线改对,以及把一个不再需要的开关关掉。
期号2026-10-07§1开场§2一根线上的四个角色§3自己听见自己§4那个看起来完全正确的开关
EP04404,大脑失忆导致全场空答案14:31
最贵的故障不报错,它不崩、不红屏、不写日志,只是安静地什么都不说;抓住它靠的不是运气,而是每一层都提前留了账。
期号2026-10-07§1开场§2一切都正常,除了一个字都没有§3先别急着修,先把每一层量出来§4会话编号,AI 靠它记住聊过什么
EP05指标诚实的代价:三个数字与它们的口径16:20
一场面试跑完,屏幕上落下两个数字——听对率 100%、送达率 33.4%,同一场、同一套代码,一个满分一个不及格。问题不在哪个数字错了,而在它们量的是不同的东西;而把口径改对之后要付的五笔代价,才是这一集真正的主题。
期号2026-10-07§1开场§2三个数字在量什么§3三十三点四是怎么来的§4推理链断在哪
EP06冻结纪律:为了不被骗,先冻住自己的结论16:42
冻结一条结论,理由不是"我确定它对",而是<span style="font-weight:600">"我不确定它对,而且我知道我会怎么改错它"</span>。冻结不是信心的表达,是<span style="font-weight:600">谦逊</span>的表达。
期号2026-10-07§1开场§2第一层,不要相信文档§3第二层,结论也有保质期§4解冻要有门票
EP07bit-perfect,为什么差一个比特就是全静音14:45
在这条路上,一致性是死线不是优化项;四个端点必须全部二十四比特四万八千赫兹,不一致的结果不是变难听,是零。
期号2026-10-07§1开场§2先把 bit-perfect 这个词掰开§3为什么结局是全零,而不是差一点§4症状骗人的时候,最难修
EP08装了驱动不重启:最阴险的一种故障15:41
最阴险的故障不是报错,而是<span style="font-weight:600">「设备在、能枚举、设置界面看得见,但它不传信号」</span>。我们被它骗了整整一个下午——而真正需要做的动作只有两个:重启,和把采样率对齐。
期号2026-10-07§1开场§2那个下午发生了什么§3卸载之后就好了,然后呢§4为什么不重启就等于没装
EP09静默的 blob,一段 URL 如何骗过了整个系统14:44
系统告诉你的「完成」,和世界真的发生变化,是两件不同的事;这一集讲同一家族的三种「播完了但没播出来」。
期号2026-10-07§1开场§2声音是怎么被塞进那根线的§3给一段音频起名字的两种方式§4播完了,但电平是零
EP10打断的艺术:平台说「没听到」时你在干什么15:16
平台说"没听到"的时候,最直觉的反应是停下来重说——而那恰恰是亲手制造它抱怨的那件事。这套守卫的目标从来不是"像真人说话",而是<span style="font-weight:600">像真人那样守规矩</span>。
期号2026-10-07§1开场§2一次打断到底删掉了什么§3催场句必须被豁免§4十二个字的门槛
EP11首句系统性丢失,50% 到 5% 的真相14:42
一个指标拦下了一个会走歪的方案——成立的前提是「丢失发生在尾部」,而真实情况恰恰发生在头部。
期号2026-10-07§1开场§2那些从半句开始的答案§3平台不认我们的句子边界§4一个被假定成前提的想法
EP12碎片化:一句「没听到」背后的 3 到 10 秒15:22
问题不是声音太小、不是发音不准、不是网络卡顿,而是<span style="font-weight:600">声音太碎</span>。从任何单点看系统都正常——合成成功、播放成功、电平有值、转写有字——但平台仍判定"这个人没在说话"。
期号2026-10-08§1开场§2逐句合成看起来很聪明§3平台听的是一段话,不是一串句子§4把嘴搬到本机
EP13跑了六场才看清:被噪声误导的两次改动18:23
优化一个由外部平台裁决的系统时,最像成果的那个数字往往最不可信——总播报量在相邻参数下波动 10 倍, 真正能用来判改动的,只有「同一场次内可复现」的那几个指标。
期号2026-10-08§1开场§2六场实测与那个十倍波动§3第一次误导:为了不超时,我们把答案切掉了一半§4第二次误导:改对了方向,却改错了那一行
EP14宁可超时,也不能说一半16:07
我们为了「不超时」把答案砍短,结果全场只播出十三秒、三百六十六秒草草收场;超时只是被再问一句,说一半是这一轮直接终止,这两种失败的代价差一个数量级。
期号2026-10-08§1开场§2一次看起来有十足把握的改动§3那份数据本身是错的§4十三秒和三百六十六秒
EP15自指悖论:修好之后,就再也测不到修好的那条路14:49
一个修复一旦真的生效,那条被修复的路径就再也不会被触发——于是你永久失去了证明它修好的机会。 应对办法是把验证搬离线:固定三场历史产物做回放基线,并强制每个检查器自己说出验证了什么。
期号2026-10-08§1开场§2一个永远走不到的分支§3第一类自指:修复让触发条件消失§4第二类自指:检查器说自己没问题
EP1645 个探针脚本,我们为什么不直接跑真场15:40
四十五个脚本里只有一个在跑场,不是因为我们爱写工具,而是跑一场能证明的东西太少、跑砸一场留下的东西太多;真场负责采集,场外负责证明。
期号2026-10-08§1开场§2四十五个脚本里只有一个在跑场§3真场当不了测试床,第一条理由是噪声§4真场当不了测试床,第二条理由是它不可逆
EP17冲突台账:把裁决写进文档,而不是写进代码18:11
文档里两条结论打架时,不许偷偷改掉一个,也不许谁嗓门大谁赢——把矛盾原样登记进冲突台账, 写清冲突双方、现象与候选方案,等人类拍板,再把裁决集中落到一张表上。
期号2026-10-08§1开场§2一份会自己打架的文档§3C-001:一个结论是怎么被推翻的§4反直觉:发现冲突不许自己裁决
EP18边界是怎么守住的15:04
边界不是用来限制能力的,是用来保护证据可信度的;一旦跨过去一次,你测出来的所有东西都不值钱了。
期号2026-10-08§1开场§2边界写在文档里,不写在心里§3摄像头,最容易跨过去的那条线§4平台的问题,我们取证,但不绕

没有匹配的单集。