
今晚这条线,是 AI 把手伸进了两个最不该省事的地方:判断与自我。16:55 到 20:55 这个窗口里,前 OpenAI 研究员做出的 Jev 只做判断、不写一个字,两周内被中国团队用开源和本地化补上缺口,StartLux 的决策模型在 38 项基准里 31 项反超 Jev——「直觉层」正被从大模型里剥出来,做成廉价又高频的基础设施。同一时段,OpenAI 安全团队负责人用一封离职信掀开「速度优先」的文化裂缝,AlphaEvolve 式的自我改进让「AI 造 AI」从远景变成排期问题。更硬的一手在美国:9 月 30 日自主作战司令部成立,AI 从辅助工具被抬成作战单元。国产 AI 短剧则用月均四万部的产能,把内容产业的「代议制」直接掀翻。热闹的是模型,发凉的是边界:判断可以外包,责任却没人愿意接。今晚的看点,不在谁又刷了榜,而在谁先给这些能力装上刹车。
🌙 晚安问候
夜深了,把屏幕亮度再压一档,别让今天的跑分、估值和辞职信跟着进被窝。今天是农历丙午年八月二十四,秋意一夜深过一夜,泡杯温水,早点歇。
🌛 七叔说报 · 深夜烧烤
七叔把炉子重新生上。国庆过半的夜里,这炉子烤出来的味道却越来越像同一种——AI 把自己拆成了零件,能卖的卖,能省的省,只有责任没人肯接。来,先上五串硬菜,再翻四碟小菜。
🔥 核心要闻
今晚最值得盯的一条,是 AI 学会「只想不写」之后,判断这件事被单独拿出来定价。
引用来源:《Jev 之后,中国团队开始深挖 AI 的「直觉层」》(链接)(极客公园 · maomu.com · 36Kr 等 3 家报道)
9 月 15 日,前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布 Jev,它不生成一个字、只做判断,把决策从生成里剥成廉价高频的基础设施;但它闭源托管、无法本地部署,留下缺口。两周内 OpenAI 推出 Decisions API,Cloudflare、亚马逊相继跟进,国内上海人工智能实验室与成立不足五个月、由盛大联合创始人陈大年掌舵的 StartLux 则清一色走开源与本地化。StartLux 靠自研 Auto Research 体系 3 天出模型,27B 版在 38 项基准中 31 项高于 Jev。护城河尚不清晰,真正的价值落点,恐怕是把这些「判断模块」组装成完整产品的能力,而不是模型本身。

比模型跑分更刺眼的,是造模型的人自己开始写辞职信。
引用来源:《OpenAI元老的一封离职信,揭开了奥特曼最不想承认的真相》(链接)(虎嗅 · 36氪 等 2 家报道)
OpenAI 安全团队负责人 David Robinson 因不满公司「速度优先」的企业文化离职,并在《大西洋月刊》撰文警告 AI 安全风险,相关讨论在 Hacker News 上引来 527 条评论。别只把它读成宫斗:当负责「踩刹车」的人相继离席,说明内部对安全与商业的排序已经失衡。「教会 AI 善待人类之前,先学会善待同事」——这句话今晚被反复转引,不是抒情,是治理预警。

如果说离职信是刹车片在响,那这条就是发动机自己在加速。
引用来源:《当AI开始制造AI》(链接)(虎嗅 · 钛媒体 等 2 家报道)
文章以 Google 的 AlphaEvolve 为例——它优化的算法让 Gemini 训练提速约 1%,把「递归自我改进(RSI)」从远景拉进现实:AI 参与下一代 AI 的研发,研发成果又反过来加快研发。真正的难点不是「更快」,而是谁定义进步、谁来做独立的安全验证。企业害怕落后,不能替代我们对这场加速是否值得的判断。

最让人后背发凉的一条,发生在五角大楼的编制表上。
引用来源:《美国成立自主作战司令部:AI成为作战单位,刹车已经被拆掉了》(链接)(斯凯有话说 · 2026-10-04 14:08)
2026 年 9 月 30 日,美国国防部长赫格塞思宣布组建自主作战司令部,预计 2027 年 10 月 1 日前运作,统管无人机、AI 与指挥控制系统;与此同时,美方在内部迫使企业解除伦理限制,在国际上删除 AI 武器安全条款。文章还引用 Maven AI 误炸小学、造成 150 余人死亡的事件,指出责任被层层稀释。从「辅助工具」到「作战单元」,变的是授权,不变的是——真出了问题,没有人可以站上被告席。

技术层在争夺边界,内容层则在被直接「掀桌」。
引用来源:《“规矩不能坏” 刷屏背后:AI 正在拆掉内容产业的 “代议制”》(链接)(针尖 · 2026-10-04 13:42)
2025 年国庆前后,AI 短剧台词「规矩不能坏」全网刷屏;AI 短剧月均产能约 4 万部、生产周期 7–15 天、爽点模块化,直接对着大众情绪供给,绕开了传统内容的精英叙事与「代议制」,把话语权下移。代价也随之而来:内容扁平化、情绪麻醉、审美趋同。它证明的不是 AI 会写剧本,而是当生产端被彻底降本,分发端的旧秩序也会被重新洗牌。

五串硬菜啃完,从决策模型、离职信、AI 造 AI,一路聊到作战司令部与 AI 短剧,翻今晚四碟小菜。先看科技这桌:终端在玩花样,模型在换姿势。
⚙️ 科技速览
先看程序员把终端玩成了游乐场。
引用来源:《Claude Code 的「乐高」模式,让程序员彻底玩「上头」了》(链接)(极客公园 · 2026-10-04 13:16)
最近两周,开发者把 Claude Code 的输入框改造成像素宠物与乐高积木,工具一调用宠物就吃一口饭、失败就当场生气。看似玩梗,实则是插件化带来的副作用:当 Agent 的能力被拆成可插拔模块,它的「界面」就不再由厂商单方面定义,而由社区拼装。谁掌握了插件生态,谁就掌握了使用习惯——这比跑分更黏人。

再看一个把「写作」排在「代码」前面的前沿模型。
引用来源:《Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型》(链接)(爱范儿 · 2026-10-01 08:31)
Gemini 4 正式发布,爱范儿的评价很克制:跑分不可思议,能力谨慎怀疑,但它第一次让「写作强于代码」成为前沿模型的标签。这对以编程为默认场景的评测体系是个提醒——当模型的长板从逻辑转向表达,企业的选型标准也该从「谁的代码准」扩到「谁的文字稳」。别急着照发布会下注,等实测评测定调更稳。

最后一条,是给「看得见的厨房」验真。
引用来源:《央视曝光外卖"明厨亮灶"造假,湖北、云南等地核查处置》(链接)(IT之家 · 2026-10-04 18:06)
央视《每周质量报告》曝光部分外卖商户把「明厨亮灶」摄像头随意摆放、故意偏角,避开切配、烹饪、洗消等关键区域,市场监管总局随即部署湖南、湖北、云南等地核查。监控本是为了透明,结果被摆拍成一门「镜头管理」的生意。这提醒我们:任何监督设计,只要执行者的动机与监督目标不一致,摄像头就会自动学会「看不见」。
关掉后厨的镜头,把视线放回假期的街面。
🌆 生活速览
先看一块把纪录顶到新高的金牌。
引用来源:《中国体育在突破与传承中拓展新空间》(链接)(中国新闻网 · 2026-10-04 20:47)
爱知·名古屋亚运会落幕,中国代表团收获 169 金 89 银 83 铜共 341 枚奖牌,连续十二届问鼎亚运金牌榜,金牌数创中国代表团境外参赛新高。数字耀眼,但更该被看见的是结构:撑起基本盘的,往往仍是那些曝光度不高的「苦项目」。荣誉是集体的,如何让冷门项目的运动员也分到流量与商业的红利,才是下一道题。
再看一条被 AI 拿来「恶作剧」的景区。
引用来源:《景区官方:乐山大佛"掏耳朵"“掏鼻孔"视频系AI合成》(链接)(中国新闻网 · 2026-10-04 18:34)
网络流传的「乐山大佛开展养护作业」短视频被乐山大佛管委会证实为 AI 合成,所谓「掏耳朵」「掏鼻孔」并不属实。它没有造成实质伤害,却再次消耗了公共信息的可信度——当伪造一段以假乱真的视频只要几分钟,官方「辟谣」永远慢半拍就会成为常态。对普通人来说,看到离谱现场先别转,是成本最低的自保。
最后,秋天这次是真的到了。
引用来源:《长三角多地官宣入秋 冷空气携降温大风登场》(链接)(中国新闻网 · 2026-10-04 20:47)
一股冷空气 4 日自北向南影响长三角,带来降温、大风和降雨,杭州、宁波等地相继官宣入秋,江苏也有望近期全面入秋。对刚在假期里晒到发烫的人来说,这是最直观的一次「季节切换」。提醒一句:昼夜温差拉大,老人孩子的呼吸道与心脑血管最怕这种急降温,衣柜里那件外套该翻出来了。
街上冷了,坐回键盘前,开发这桌今晚聊的是预算、文档和判断。
💻 开发速览
先看一条给 AI 花钱划红线的呼吁。
引用来源:《We’re going to need default hard budget caps on pretty much everything》(链接)(Hacker News · 2026-10-04 08:20)
Simon Willison 撰文主张,几乎一切自动化与 Agent 都该有默认的「硬性预算上限」,该话题在 HN 上拿到 486 赞、244 条评论。这话放在今晚再合适不过:批量生成的边际成本趋近于零,失控的往往不是单次调用,而是没人设上限时那些悄悄跑了一整夜的循环。给 Agent 装钱包,可能比给它换更强的模型更紧急。
再看一句关于 Agent 记忆的反常识判断。
引用来源:《Agents don’t need memory, they need documentation》(链接)(Hacker News · 2026-10-04 01:03)
文章主张 Agent 缺的不是「记忆」,而是「文档」,HN 上 224 赞、128 条评论。逻辑很朴素:堆砌的记忆是黑箱,随会话漂移且难以审计,而结构化的文档是可读、可版本化、可交接的确定性来源。把上下文当记忆养,只会越养越脏;把它当文档维护,团队协作才真正成立。
最后是一个把「判断」做小的开源项目。
引用来源:《firelex/jeff》(链接)(GitHub · 2026-09-29 00:18)
jeff 主打「毫秒级决策、任意领域」,用 0.8B 的「系统 1」小模型在你的选项之间给出带校准概率的选择,一个基座配可替换的 LoRA 适配器,已收获 1357 颗星。把它和今晚开头的 Jev、StartLux 放在一起,路径就很清楚:大模型负责想,小模型负责判断,「判断」正被做成随处可插的廉价零件。对开发者来说,这比追更大的模型更务实。

代码看久了,假期尾巴也给家里添点实在的。
🛒 购物速览
先看一台价格松动的中端主力机。
引用来源:《华为 nova 15 Pro 昆仑玻璃版 手机 12GB+512GB 带感绿》(链接)(什么值得买 · 京东 · 2026-10-04 20:51)
华为 nova 15 Pro 昆仑玻璃版 12GB+512GB 京东活动价 3079 元,叠加首购礼金、京豆返现、优惠券、国家补贴与 PLUS 立减后还能再压一截。中端机在国庆是走量最密的窗口,昆仑玻璃加大存储的组合把耐用与大容量一次给到。提醒一句:国补常有地区与名额限制,下单前先确认能不能用、何时到账,别被「到手价」钓着走。

再看一件提前入冬的童装。
引用来源:《匡威 儿童高绒羽绒服 多色全尺码 充绒量176g》(链接)(什么值得买 · 京东 · 2026-10-04 20:55)
匡威儿童高绒羽绒服参与满 1 元打 5 折,实付低至 219 元,标注充绒量 176g,多色全尺码。给孩子买羽绒服,关键指标不是牌子而是充绒量与绒子含量——176g 属于能扛过南方湿冷和初冬的量级。冷空气刚到长三角,这类应季刚需通常一两周内就会开始断码,看到合适尺码不必犹豫。

最后来点应季的零嘴。
引用来源:《京觅 陕西大荔冬枣 净重5斤 单果16g+ 现摘现发 生鲜水果 源头直发》(链接)(什么值得买 · 京东 · 2026-10-04 20:50)
陕西大荔冬枣净重 5 斤、单果 16g+,京东活动价 29.9 元,领满 19 减 5 券后 24.9 元包邮。大荔是全国冬枣核心产区,这个价位折合每斤不到五块,属于「季节限定的便宜」。唯一的门槛是生鲜怕压怕捂,收货后尽快开箱分装冷藏,别让它烂在快递箱里。

七叔收口
今晚的主线其实就一句话:AI 正在把自己拆开卖。判断被剥离成 Jev 与 jeff 这样的小零件,生成交给大模型,自我改进交给 AlphaEvolve 这样的循环,边界则交给五角大楼和内容平台去试探。中国团队这次罕见地没有掉队——开源加本地化,把闭源 Jev 留下的空位补上,也让全球玩家不得不共用这套底座。可越是这样越该记住:能力可以模块化,责任不能。接下来盯三件事——决策模型会不会沦为一次性的流量品类、自主武器的事故最终谁来兜底、以及内容被 AI 降本后的话语权落在谁手里。热闹属于模型,警钟属于我们。
🛏️ 睡前通知
睡前把今晚的要点拢一遍。做研究的留意,AI 正在把「判断」做成可开源、可本地部署的小模型,StartLux 一口气放出 0.8B 到 27B 五档,想自建决策层的人可以下场试试水位。做开发与 Agent 的,Simon Willison 那句「给一切都加上硬预算上限」值得抄进备忘录,本地跑 0.8B 判断模型也已是可行选项;同时别再把 Agent 的上下文当记忆堆,试着把它当文档来维护。购物的,华为 nova 15 Pro 补贴后约 3079 元,匡威儿童羽绒服 219 元、京觅 5 斤冬枣 24.9 元,应季刚需看到合适就下手,但国补的叠加顺序务必当场算清。生活的,长三角今夜起大风降温,乐山大佛的「掏耳朵」视频已被证实是 AI 合成,离谱现场先别转。看完这些,愿你今晚的选择题只剩一道:几点睡。
夜深了,泡杯温水,把今天的热闹挡在门外,你也早点歇。
🍲 深夜毒鸡汤
判断可以外包给模型,但承担后果的那个人永远只能是你自己——省事可以,别把判断也省掉。
评论交流