X PAPER纸媒模式
往期
菜单
—
报纸版面
THE PERSONAL DAILY 2026年10月5日星期一 第 001 期 / 主编编订
来自你的关注
为阅读重新编排

X Paper 阅

你的关注,今日成报。

慢一点读
看清谁说了什么
76 个关注来源 · 本期稿件 41 条 观点有署名 · 阅读有出处
本期导读

本期从AI工具的承诺与验收出发,补读无人卡车的采用速度、财政支出的落地和就业口径;背面展开减重试验的人群与安全、研发实验室的改造及蛋白质水印的检测边界。市场、公共生活与文化消息分别署名,保留证据和限制。

OCT
05
AI 与科技

28 天承诺之后,Codex 要回答什么算“改进”

在 OpenAI 从事 Codex 与 ChatGPT 工作的 Tibo(@thsottiaux)承诺:接下来 28 天,每天要么交付对多数 Codex/Work 用户有用的明显改进,要么全面重置。用户随即追问:什么才算改进,谁来判定?

这不是一条孤立的促销口号。10 月 4 日,Tibo 先把正在做的工作收拢为四个方向:简化、提高效率以支持更多使用、开创性功能或新模型。他承认用户反馈很明确——希望事情更简单。到了北京时间 10 月 5 日凌晨,他引用这条回应,给出了 28 天的期限。

他给出的条件不是只要有发布,而是改进必须明显,并与多数 Codex/Work 用户相关。Codex 是面向编程任务的 AI 工具;Work 是他在承诺中使用的产品称谓。宝玉将承诺转述为每天上新,否则重置额度;Gorden Sun 则追问由谁判定有效、是否会把一项功能拆成多天发布,并表示自己更希望得到额度和模型改善。原帖没有在这条承诺里解释全面重置涉及哪些额度、账户与执行时间。

兑现问题已经有前情。10 月 3 日,Tibo 发帖称部分被他称为“Pro 500”的订阅用户此前没有得到预期重置,正在调查;之后又称问题已修复。这里只能确认他报告了调查和修复,不能替所有账户确认结果。但这使“重置”成为需要检查执行的事项,而不只是公告里的一个词。

承诺与质疑之间的差别,是发布动作和使用收益能否对应:公告可以逐日出现,但额度是否恢复、功能是否解决原有问题,需要检查实际结果。此前重置问题说明这不是纯粹的措辞之争。本期能确认的是承诺、用户回应和 Tibo 自述的修复;28 天的兑现情况尚未形成。

原帖、前情与补充来源已复审

AI 与科技

Claude Mods:把上下文、工具调用和下一步动作放进界面

Boris Cherny 介绍的 Mods,让 Claude Code 用户改造编程助手的界面与行为:不仅增加提示,还能在工具执行前插入处理步骤,并把这些改造作为插件分享。

普通技能主要向模型提供说明,外部工具向模型提供能力;Mods 则以 JavaScript 或 TypeScript 代码在 Claude Code 内响应事件。提交提示、准备调用工具、绘制界面时,它可以观察事件、修改事件,或接管处理。因此,它既能增加面板,也能改变一次操作如何继续。

官方示例 blast-radius 展示了完整用途:遇到删除文件或强制推送等命令时,先暂停调用,显示预计影响,再给用户继续或取消的按钮。另一个示例 token-weather 在输入区上方显示上下文窗口的使用情况——也就是模型这一轮能容纳的信息用了多少。replay-theater 则用 /replay 逐步回放上一轮的文件修改。ClaudeDevs 的接续示例进一步说明:token-weather 除了显示用量,还画出过去十二轮的变化,让用户看见上下文如何被逐步填满。

Thariq 展示的 next-steps 会建议接下来可选的技能与命令;ClaudeDevs 的 You should Know 则提示输出中可能被忽略的信息。这些例子分别处理做什么、注意什么以及执行前看清什么,把原本需要用户自己记住的步骤放到使用现场。

用户可以向 Claude 描述想要的改造,让它生成 Mod,或安装已有插件。官方文档说明,界面扩展可用于终端版与 Claude Desktop 的 Code 标签页;各使用环境的支持范围并不相同。Mod 运行代码并拥有用户权限,所以选择插件时也要考虑其作者与来源。这里报告的是已公布的能力和示例,并非本报安装后的效果评测。

原帖、前情与补充来源已复审

生物医药

蛋白质水印如何留下 AI 设计的痕迹

DeepMind 的 SynthID Bio 尝试把来源标记写进蛋白质序列或预测的三维结构。Hassabis 与 Pichai 介绍的进展,是一项保留生物功能的概念验证,还不是识别所有 AI 生物设计的通用检测器。

水印不只是附在文件旁的标签。对序列,方法轻微引导氨基酸的选择;对预测结构,则调整原子的三维坐标,让结果携带可检测的信号。序列标记的目标是让设计被合成为真实蛋白质后,仍保有可核验的来源线索。

团队用 AlphaProteo 与加入水印的 ProteinMPNN 设计能与特定目标结合的蛋白质。在 VEGF-A、SARS-CoV-2 刺突蛋白的受体结合域和 PD-L1 三个目标的实验中,团队报告带水印与无水印设计的成功率、结合强度和序列多样性相近。检验的是这些设计能否结合目标,并不等于证明所有功能都不受水印影响。

对结构预测,团队微调了 AlphaFold 3 的部分扩散网络,使输出坐标自带信号;报告称预测准确性得到保留,检测可承受数字噪声或小幅坐标修改。抵抗有意篡改仍是后续难题。

这项工作的用途,是给合成审核和生物数据库增加来源线索:陌生序列可能是自然发现,也可能由 AI 设计;误标的合成结构又可能影响后续研究。水印帮助区分来源,却不能独自判断设计是否危险。此次公布的是研究方法与实验结果,实际采用和更强的抗篡改能力仍待推进。

Google DeepMind 的播客进一步解释了检测边界:文字水印依赖可选择的词语,极短且答案固定的句子可能无法标记;不同系统要检测彼此的输出,需要共享相应密钥。生物设计的实际部署还需要模型提供者与合成机构协调。水印未检出,不能反过来证明来源天然或内容安全。本报读完了该期文字稿,未独立审听音频。

原帖、前情与补充来源已复审

AI 与科技

工具能替你造,眼光仍要自己练

Thariq 的游戏原型展示了一种具体合作方式:让 Claude 找参考、教自己,再造一个可以反复修改跳跃动作的编辑器。成果之后,他坦言自己已经到了判断力的边界。

前一天介绍这个个人项目时,他已提出自己的边界:做游戏本身令人满足,不要把创作整个外包,要用 AI 一起实现自己的愿景。到了动画更新,他不是要求模型一次交出成品,而是让它搭出能持续试验的工具。

随后接在同一串里的回复,让这次展示比单纯的成果视频多了一层信息。他相信作品还有很多问题和改进空间,但自己的技能已不足以继续判断,需要培养更好的眼光。

这段实践把两种能力分开了:工具能帮助搭建编辑器、扩大试验范围,创作者仍要判断怎样的动作更好。当一次生成达不到预期时,先建立比较、修改和练习的环境,是他提供的一种工作方法;但扩大试验能力并不自动产生质量标准。

原帖、前情与补充来源已复审

金融与商业

2025 年美国车龄 12.8 年:更耐用,还是换车更贵?

Charlie Bilello 重提美国汽车越来越老。追到统计来源,12.8 年是 2025 年乘用车与轻型卡车的合计均值:其中乘用车已达 14.5 年,轻型卡车为 11.9 年。

Bilello 给出两种解释:车更耐用,换车也更贵。两者可以同时成立,却不是同一种消费信号。一种是现有产品仍能满足需要,另一种是更换成本让人延后购买。

美国交通统计局列出的近年来源为 S&P Global Mobility;后者的 2025 年分析确认了 12.8 年及车型差异。因此,不能把合计均值直接当作每类车主都经历了同样的变化,也不能把这份旧年度数据写成今年刚出现的新纪录。

因此,这张图首先说明车辆使用年限的变化。更耐用与更昂贵是 Bilello 提出的解释,图表本身没有测量两种因素各自的贡献;从平均车龄也不能直接推出某家汽车或维修公司的盈利变化。

原帖、前情与补充来源已复审

政策与国际

最高法院的新任期,始于持续低迷的公众评价

Bremmer 提醒关注最高法院信任下滑。追查 Gallup 9 月调查,司法信任为 46%,最高法院工作认可度为 34%;两项都处低位,但不能混作一个数字。

Gallup 于 9 月 1—17 日进行年度治理调查,9 月 30 日公布结果,Bremmer 随后转述。46% 是对以最高法院为首的联邦司法部门表示高度或相当信任的人数比例;34% 则是认可最高法院工作表现的比例。它们问的是不同问题。

工作认可度与七月的 33% 基本持平,61% 不认可。司法信任为连续第五年低于一半,略低于 2022—2025 年的 47%—49%。所以此次结果应理解为评价持续低迷,不能把 34% 写成刚刚再次刷新的最低点。

政党差异比总体均值更鲜明:民主党人、独立人士与共和党人的司法信任分别为 23%、42% 和 79%;工作认可度分别为 12%、31% 和 65%。新任期面对的不是统一的负面评价,而是明显分化的公众。

Gallup 把长期变化与法院转向保守派多数、此后推翻联邦堕胎权保障的裁决联系起来。不过这项调查没有把每项裁决的因果贡献单独量化,也不是发帖当天事件引发的即时反应。

原帖、前情与补充来源已复审

AI 与科技

归藏展示 Muse 固件界面,联网功能待演示

10 月 3 日,归藏介绍可连接 ESP32 设备的 Muse Gadgets SDK;两天后,他称已把固件刷入 M5 Stack 的 Stop Watch Meta,并晒出圆形屏幕照片。

SDK 是供开发者使用的软件工具包;这里的固件是写入设备、让设备运行的程序。归藏说工具包已内置数种常见 ESP32 设备的固件,因此不必从零写程序。他的前帖描述的目标,是让小设备连接 Muse、获取有关 Muse 的信息,再制作自己的周边。

照片中,圆屏已经显示像素角色和 SET UP WI-FI 提示。这能看到程序界面已运行,但照片没有展示联网后的信息更新,也没有演示语音或双向交互。对这一实践,目前可确认的进展是刷机与界面展示;具体能做什么、如何与 Muse 交互,仍需后续演示。

实践进展;联网后的功能尚待演示

文化与生活

唱片与巡演:音乐账号这周有哪些新消息

The Beatles 发布 Rubber Soul 特别版;Red Hot Chili Peppers 公布 Stadium Arcadium 二十周年限量黑胶。Muse 则预告 2027 年 1 月重返欧洲,并开放艺人预售登记。

The Beatles 在 10 月 2 日公告 Rubber Soul 特别版已发布。Red Hot Chili Peppers 的消息针对 Stadium Arcadium 二十周年限量黑胶,购买入口为乐队官网。

Muse 预告 2027 年 1 月重返欧洲,并提供艺人预售登记入口。登记属于购票前的步骤,不能当作已经购得门票;具体场次与售票信息需以乐队公告为准。

原帖、前情与补充来源已复审

AI 与科技

把计算搬到太空,Pichai 报告原型卫星发射

Pichai 回忆团队最初提出太空计算的设想,并在 10 月 2 日报告与 Planet 合作的原型卫星已成功发射。

他在发言中向 SpaceX 致谢,强调项目既展示了已有进展,也仍有很长的路要走。

这条消息确认的是他报告的原型阶段进展,尚未提供卫星算力、运行成本或面向用户的服务时间。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

闲置十五年的 PSP,成为 Muse 的语音入口

Wang 转发 Robert Soriano 的实践:把 Muse 小工具客户端移植到 C 语言,让一台闲置超过十五年的 PSP 成为语音入口。

Soriano 说,按住 R 键对内置麦克风讲话,Muse 会回答,声音由 OpenAI 提供;移植过程中使用了自己的代理。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

Thariq 向公司领导者征集 AI 编码问题

平时面向开发者写作的 Thariq,准备把下一篇文章写给正在应对 AI 编码代理变化的公司领导者。

他向读者征集两个方向的问题:希望领导层理解代理的哪些事情;经营公司时遇到了什么困难。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

Claude.dev 集中工程文章与开发指南

ClaudeDevs 在 10 月 1 日介绍 Claude.dev,作为面向使用 Claude 构建产品的开发者的新入口。

公告列出的内容包括工程深度解析、Claude Code 与 API 指南,以及构建 Claude 的团队提供的提示。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

归藏做了折叠屏屏保,是否开源还在征询

归藏说自己做了一个安卓折叠屏屏保应用,模仿 iPhone Duo 半折状态下的屏保。

因为认为使用者可能不多,他暂时没有发布,并表示如果有人需要,可以开源。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

Tibo 把收件箱清零交给 dot,报告首次完成

Tibo 在 10 月 4 日报告,给 dot 设定主动帮助清理邮件的目标后,自己第一次实现了收件箱清零。

他引用两天前的记录:未读邮件从超过 9,000 封降到 6,110 封,并提出在随后 48 小时内通过过滤清理到零。他同时表示,还要看看清零状态能持续多久。

公告与作者发言摘读

AI 与科技

Altman 对把判断力交给 AI 表示不安

Sam Altman 在 10 月 3 日表示,对人们把宗教力量赋予 AI 模型,或放弃人类自身判断力的倾向感到非常不安。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

Altman 回应 Cerebras 合作猜测

针对外界对 OpenAI 与 Cerebras 合作的猜测,Altman 在 10 月 3 日称 Cerebras 是密切合作伙伴,双方在速度前沿有深入合作。

这条回应没有公布合同规模、算力采购数量、合作期限或具体上线产品。

公告与作者发言摘读

X 原帖本文链接
AI 与科技

OpenAI 与 ASBDC 合作,为小企业提供 AI 指导

OpenAI 在 10 月 1 日介绍一份小企业使用 AI 代理的报告,并宣布与 ASBDC 合作提供实操培训和本地指导。

公告把寻找客户、构建产品和管理财务列为小团队使用 AI 的任务方向。

公告与作者发言摘读

X 原帖本文链接
政策与国际

Cato 文章奖公布五万美元奖金与征稿时间

Cato Institute 宣布,自由愿景奖将为最佳自由意志主义文章提供 50,000 美元奖金,投稿于 2027 年 3 月 1 日开放。

公告称欢迎任何人申请,当前提供的是登记接收更新的入口。

登记提醒和正式投稿是两个步骤;具体篇幅、评审与提交要求仍需以完整征稿规则为准。

公告与作者发言摘读

X 原帖本文链接
政策与国际

Obama 转发律师投票权志愿招募

Obama 在 10 月 2 日为 We The Action 的招募发声,呼吁律师志愿投入时间维护投票权。

他把律师称为保护民主制度斗争的前线力量,并附上 wetheaction.us/guide 指南入口。

公告与作者发言摘读

X 原帖本文链接
文化与生活

OneRepublic 预告十二月 Jingle Ball 演出

OneRepublic 在 10 月 3 日预告参加今年十二月的 iHeart Jingle Ball,并称门票已开售。

公告没有在这条短帖中列出具体城市、日期与票价。

公告与作者发言摘读

X 原帖本文链接
金融与商业

指数在高位,仓位为何仍被判断为中性?

Liz Ann Sonders 的最新播客讨论上涨背后的分化:Vanda 的 Eric Liu 转为看多美股,但他看的是仓位,并非所有股票都已转强。

Liu 称,Vanda 自 2010 年起追踪的美股仓位接近历史均值,债券多头也已大幅退出;他因此倾向大型科技股。仓位描述资金已有的市场敞口,与指数价格是两回事。这是他的模型判断,节目没有披露可供复算的完整数据。他还把近期冲突中的反应不对称作为看多理由:利率回落时的股市反弹较强。但少量历史情形不能当作未来涨幅规律。

另一把尺子是市场广度:有多少股票参与上涨,常用上涨与下跌家数、站上均线的比例衡量。少数权重股就能拉高指数;若多数股票落后,上涨便更依赖领涨者。

广度窄不直接推翻仓位偏中性的判断,二者回答的问题不同。读这次转向,既要看资金是否拥挤,也要看上涨是否扩散;单凭指数高点,无法回答这两个问题。

播客相关段落与指标定义已复核;仓位模型未独立验证

生物医药

手表的恢复分数,离健康结论还有多远

Eric Topol 再次分享 9 月的长文,质疑可穿戴设备的 HRV 与恢复分数:测到信号、解释身体状况、证明改善健康,是三个不同环节。

HRV 是相邻心跳间隔的变化。传统研究用心电图记录电信号;多数消费设备用光学传感器记录脉搏,再推算变异性。Topol 指出,低 HRV 与疾病风险的关联,不等于把读数提高就能改善健康;恢复分数与健康结局的联系仍缺少验证。

他引用的一项 2025 年研究,在单一医疗机构对 931 人静坐测量 5—7 分钟。同一上臂设备的光学 RMSSD 均值为 37.49 毫秒,心电值为 43.14 毫秒;RMSSD 表示相邻正常心跳间隔差异的大小。两种方法的读数不能直接视为相同。

这项研究没有测试 Apple Watch,也没有追踪使用分数后是否更健康;四名作者受雇于设备商 Tiger Tech。它提示测量方法存在差异,不能据此判定每款手表的误差。

Topol 的批评针对把指标包装成健康结论,不是否定所有可穿戴功能。不同品牌的恢复分数不能直接比较;看到一个低分,也不能仅凭它判断身体变差。

长文及所引研究的方法、表格、限制和利益关系已复核

政策与国际

租户获返家协议,西班牙住房抗议为何仍继续

一位 87 岁租户被驱逐后,已达成低租金返家的协议;但面向更多租户的住房法令遭否决,个案转机没有终结抗议。

玛丽卡门·阿巴斯卡尔在马德里居住数十年,因无法承担涨租被驱逐,随后住院。她的律师 9 月 29 日告诉美联社,返家协议把租金限制在收入的 30%,不超过原来的每月 500 欧元。这是达成协议,不能写成已确认搬回家。

BBC 10 月 4 日报道,政府提出的两项住房法令于此前星期五遭议会否决。措施包括把弱势租户的驱逐暂停期延至 2030 年,以及租约延长、自动续签等安排;这些提案不能当作已经实施的保护。

第二天,约 50 场游行在马德里等城市举行。BBC 转述西班牙银行估计,住房需求与新建供给之间缺口约 70 万套。返家协议处理了一个人的处境,抗议争取的租赁保障与住房供给问题仍未解决。

BBC 全文与美联社律师采访已核对;未确认实际返家

金融与商业

牛的项圈,把围栏变成软件

Gorden Sun 用“牛工智能”介绍新西兰公司 Halter:给牛戴上智能项圈,在手机上划定放牧边界。原始公告还补上了时间和连接方式:2.2 亿美元融资在三月完成,四月已宣布卫星直连方案。

这套系统把两件事合在一起:GPS 定位告诉牧场主牛在哪里,声音和轻微振动则引导牛留在虚拟边界内、移动到下一块草场。太阳能项圈配合手机上的牧场地图,让轮换放牧不用每次重拉铁丝网。公司的后续产品还包括行为监测、发情识别和草量信息。

Gorden 描述的是依靠牧场信号塔的连接方式。Halter 4 月 28 日公告称,新项圈可直接连卫星,取消牧场内的通信塔;当时公布面向美国和新西兰肉牛业务,澳大利亚、加拿大随后推出。这里确认的是产品公告,不能据此认定每个牧场已换用卫星版。

3 月 25 日的 E 轮由 Founders Fund 领投,融资 2.2 亿美元、估值 20 亿美元。Halter 当时自报服务超过两千家农牧场,已售出一百万个项圈;“售出”不等于一百万头牛同时在线。资金计划投向现场服务、健康监测和国际扩张。

这是一条十月重新引起讨论的农业数字化案例,并非本周新融资。软件能否替代多少人工和围栏,还取决于牧场地形、部署及牛群训练;融资金额和公司案例没有给出可通用的成本回收期。

原帖与补充依据已读

AI 与科技

同一模型,换个框架就从 62% 变成 33%

Hugging Face 发布多框架强化学习实验:同一组 LFM2.5-2.6B 权重,在 Mini-SWE-Agent 的成功率为 62.1%,在 Claude Code 为 33.2%。这衡量的是 250 道留出的数据分析任务,不是通用编程榜单。

模型之外,框架决定上下文如何组织、工具如何呈现、失败如何重试以及何时停止。因此,把模型权重保持不变,也没有把整个代理系统保持不变。研究用捕获代理记录准确的生成 token 与概率,再通过 OpenEnv、Harbor 和 TRL 接上环境、任务与训练。

在 OpenCode、Claude Code、Codex、Mini-SWE-Agent 四种框架混合训练后,平均成功率从基础模型的 42.2% 升至 54.2%。只在 OpenCode 训练的版本平均为 52.3%,而在 OpenCode 自身达到 58%;多框架版本在 Claude Code 和 Codex 上更好。平均差距仅 1.9 个百分点,作者明确说在噪声范围内。

“少用 31.1% 工具调用”的分母,是基础版和训练版都做对的任务,不是全部任务或全部费用。两个训练各只有一个随机种子,混合版还看了更多不同任务、处理更多 token;缺少去掉效率奖励的对照,不能把改善全归因于某一奖励设计。

实验的实用启示是:评测要连同实际框架一起做,单一环境的高分未必能迁移。代码和模型已开放,但这组结果还不足以证明混合训练在任何任务、每个框架或同等算力下都占优。

原帖与补充依据已读

AI 与科技

AI 算对了,问题就值得研究吗?

Anthropic 刊出哈佛物理学家 Matthew Schwartz 的客座文章:他用自己的 BootLoops 项目,在三个月内与 19 位合作者做出涉及 18 个领域的 36 份研究手稿。手稿数量不是同行评审通过的论文数量。

他的做法是寻找适合 Claude 的问题:让模型编程、计算、迁移跨领域的方法,研究者负责提问和判断。项目从约四百个候选方向筛选,使用并行会话、持续更新的计划,以及互相挑错的审稿代理。Schwartz 同时是 Anthropic 的访问研究员,文章是参与者自述。

生态学案例解释了判断为什么不能省。模型发现巴拿马一处森林的物种组成变化比中性理论预测快约 4.5 倍;生态学家 James O’Dwyer 指出,定性现象早已知道,单是发现偏差还不够。研究随后转向扣除随机预测,解释余下变化的生物机制,并把人口统计模型扩展到更多样地。

遗传学项目也经历类似转折:一个罕见变异积分虽算得有趣,却未回答足够重要的生物问题。Schwartz 还记录了模型过早宣布完成、把未证明引理当公理等失败。专家反馈、图表检查和重新选题,比让代理无限重试更关键。

这份经验说明 AI 可以扩大计算和试错的范围,科学价值仍需要领域专家审查。本报读过客座全文,未逐项复现这 36 份手稿;文章也没有给出统一的算力成本或独立验证的科研产出回报率。

原帖与补充依据已读

AI 与科技

当 AI 做得更多,人怎么更快看懂?

Karpathy 认为,模型越能独立完成工作,人越要花时间监督和理解结果。他最近尝试把输出改成受控语言、示意图、交互网页和定制讲解视频,减少阅读一大段文字的负担。

文字方面,他要求模型参考 ASD-STE100——原为航空航天维修手册制定的简化技术英语规范;自己常要求约八成严格度。目的在于减少歧义和冗长表达,这只是个人提示方式,并非对模型准确率的实验结果。

对空间关系和结构,他用图像解释;需要逐步观察变化时,让模型制作 HTML 交互页面;复杂主题则尝试类似 3Blue1Brown 的讲解视频与配音。这几种形式分别调动视觉、操作和听觉,不必每个问题都做成同一种输出。

过去,为一个问题编写专用软件成本太高;如果模型能快速生成,它就可以只服务这一场解释。Karpathy 描述的是自己如何理解模型产物,尚未提供学习效果对照。形式更容易读,也仍需检查图、网页和视频中的事实是否正确。

原帖全文已读

X 原帖本文链接
金融与商业

九月就业增 2.9 万,修订还改了什么?

FXTrader 关注美国九月就业数据:非农岗位增加 2.9 万,失业率从 4.1% 升至 4.2%。BLS 10 月 2 日发布的原始统计,还把七、八月合计新增岗位下修六万,单看当月数字会漏掉这次变化。

七月从增加 2.1 万修订为减少一万,八月从增加 16.2 万修订为增加 13.3 万。修订来自更多企业报告和季节因素重算;九月数字也是初值。BLS 称此前十二个月平均每月新增 4.5 万,九月各主要行业变化不大。

失业率来自住户调查,非农岗位来自机构调查,统计对象不同。九月住户调查显示劳动力增加 48.5 万、就业人口增加 40.6 万、失业人口增加 7.8 万,参与率由 61.6% 到 61.8%。更多人进入劳动力市场时,失业率也可能上升,不能直接把两个调查相减解释为岗位流失。

私营部门平均时薪当月涨 0.1%、同比涨 3.0%。这份报告呈现新增岗位偏少、旧值下修与劳动力进入并存;BLS 也指出失业率自三月一直在 4.1%—4.3% 的窄幅区间。数据值得追踪,尚不能由一个月直接判定衰退或下一次利率决定。

原帖与补充依据已读

金融与商业

船更多,实际运力为什么反而变少?

AEI 推介的工作论文《Shipping to America》,用船舶轨迹重新衡量运力:近年来部分中断中的利用率损失达到 20—40 个百分点,而且在港口拥堵显眼之前就已出现。这里的利用率不是船上集装箱装满多少。

五位作者将 2016 年 1 月至 2025 年 3 月的 AIS 定位、速度记录与船舶资料配对,记录 58,582 次赴美航程;六条主要路线覆盖约八至九成美国海运集装箱进口。他们先计算部署船队的潜在吨海里,再扣去港口等待、运河排队、绕航和减速消耗的运力,得到有效运力及其比例。

疫情期间,更多船被调往美国:到 2022 年初,潜在运力较疫情前高逾六成,但总体利用率从约 89% 跌到不足 70%。船在等待或绕路,船队规模不能直接代表到货能力;改走另一港口,还可能把拥堵传到另一条航线。

论文用这组度量建立共享船队、拥堵和进口商调整采购的经济模型。反事实估算认为,2021 年西海岸危机和红海袭击的福利损失,分别相当于产出的 0.69% 和 0.35%。这是消费者收入等价的模型结果,不是统计机构测到的 GDP 降幅。

作者还讨论关税减少需求、缓解拥堵的条件效应,不能推广成“关税总有利”。轨迹也看不到实际货物起讫点,需结合提单进一步验证。本报核对了方法、相关图表和政策章节,未复算模型或逐项审完数学附录。

原帖与补充依据已读

AI 与科技

Claude“五折用量”,哪些额度没打折?

Claude 公告称,创建或修改 artifact 后的一部分工作消耗减半。条款限定 Pro、Max、Team,活动至 10 月 15 日 23:59(太平洋时间),Free 与 Enterprise 不含在内。

普通聊天创建或编辑后,接下来的十条消息在五小时额度中减计 50%,每次回复只含前十五个工作步骤;从 Output 菜单选择文档、演示或设计新建聊天,首条即可适用。周额度不变,额外用量付费仍按原价,Claude Code、API 和本地 Cowork 不适用。云端 Cowork 另按约前 45 分钟或创建后 80 步计算。

原帖与补充依据已读

金融与商业

ChatGPT 财务功能向美国 Free、Go 开放

ChatGPT 宣布向美国 Free 和 Go 用户推出财务功能,通过 Plaid 和 Experian 连接账户,基于个人交易与信用信息回答问题。续帖列出的用途包括找遗忘订阅和疑似重复收费、检查上涨的账单、做预算及债务偿还方案。

它还可按周更新、查看组合集中度。公告描述的是接入后分析账户的能力,不是代用户完成交易;本轮未连接账户验证,也不能把“美国推出”理解为所有地区、所有计划同时可用。

原帖与补充依据已读

金融与商业

Unusual Whales 把市场数据入口放进 ChatGPT

Unusual Whales 10 月 3 日宣布推出 ChatGPT 插件,让其市场交易数据和分析在聊天中使用,并给出了插件入口。这改变的是访问数据的工作入口。公告没有逐项说明数据覆盖、更新时延、所需订阅或授权范围;本报未安装测试,不能据此说所有数据免费或实时可用。

原帖全文已读

X 原帖本文链接
政策与国际

关税调查:48% 认为制造业受损,36% 认为受益

Cato 10 月 4 日转述其贸易调查:被归为“工人阶层”的受访者中,48% 认为关税伤害美国制造业,36% 认为有帮助,16% 认为没影响。原文以未大学毕业的注册选民代表这一组,并非按职业或收入划定所有工人。

9 月 24 日文章引用 Cato/Morning Consult 三月 2,002 人和八月 4,150 人的总样本;这两个数字不是该分组人数。它衡量政策观感,不是测定制造业实际损益;分组误差及完整问卷本轮未核对,不据此推算选举结果。

原帖与补充依据已读

文化与生活

爱知—名古屋亚运会闭幕,中国获 169 金

CCTV 10 月 5 日报道,爱知—名古屋亚运会于前一天周日闭幕。中国获得 169 金、89 银、83 铜,共 341 枚奖牌,连续第十二届居金牌榜首。CCTV 称这是中国在海外亚运会的最佳表现;本讯依据其完整闭幕短帖,未逐项核对官方比赛成绩,不展开单项赛事评价。

原帖全文已读

X 原帖本文链接
AI 与科技

Hugging Face 聊天入口重新接入 MCP

Hugging Face 宣布可通过 MCP 把自己的数据接入其 ML Intern 聊天入口。MCP 是让 AI 应用连接外部工具与数据的接口协议;价值在于回答可用到用户提供的数据。公告未交代所有连接器、权限和价格,演示未实测,本讯只确认接入功能已被官方宣布。

原帖全文已读

X 原帖本文链接
AI 与科技

Argon 把输出拉长,先交给网络防御者试用

Pichai、Hassabis 与 DeepMind 公布 Gemini 4 Argon,面向编程、企业知识工作和网络防御。首批开放的是 Fairwind 计划中的受信任测试者,普通用户还要等待。

最醒目的变化是输出上限从 6.4 万提高到 100 万 token。输出包括模型一次任务中的长篇生成,不能误读成新的输入上下文容量。DeepMind 希望它能持续完成多步骤工作,早期反馈则用来改进防护。

Google 举了两个内部应用:代理检查机群性能数据后,已释放超过 300 TiB 内存;C/C++ 向 Rust 的迁移涉及从核心库到 Fuchsia 内核的代码。公司同时说明,大规模改写仍需自动测试、人工审计和上线前审查。模型会写更多,不等于省掉验收。

公告报告 DeepSWE v1.1 得分 77.9%,该测试面向长程软件工程任务。这是 Google 公布的评估结果,本报没有复现;它也不等于任意项目都能达到同样成功率。

发布采用分阶段方式:网络防御者先测试,美国政府获得发布前访问,之后再向付费 API 用户与 Google AI Ultra 用户开放。公告所列 API 首发价为每百万输入/输出 token 2/10 美元,首发期后为 4/20 美元,缓存输入优惠 95%;这仍是公布的定价和开放计划。

本批原帖与所用外链已审读

金融与商业

财政要加快花钱,洪灏为何继续等待新政策

洪灏转述财政部长蓝佛安 10 月 1 日的文章,并预期长假后还有政策。财政部原文同时谈存量落实和研究增量,两者的执行进度不能混为一谈。

文章要求督促支出偏慢地区打通堵点,统筹超长期特别国债与地方专项债资金,并扩大贴息范围、增加经办机构、适当提高额度。这里关注的不只是安排了多少预算,还包括资金何时实际落地。

其中 3000 亿元特别国债用于有关中央金融企业补充核心一级资本,即增强银行等机构承受风险和服务实体经济的资本基础。它不是直接发给居民的消费补贴,也不能和投资支出当作同一种资金流。

使用地方政府债务结存限额的安排,原文表述为“研究出台”。结存限额是既有债务上限中尚可使用的空间;文章没有给出该项最终额度、落地日期或具体分配。不能把方向性表述写成全部资金已拨付。

洪灏说上半年预算支出偏慢,并期待节后加码;这属于他的判断。财政部文章列出的是政策任务,本身并未承诺节后的市场表现。后续要看的,是正式文件、实际发行与支出进度。

本批原帖与所用外链已审读

金融与商业

无人卡车提醒:技术能做,不等于岗位立刻消失

AEI 转发 James Pethokoukis 的文章,借无人卡车讨论 AI 替代工作的时间尺度。他的重点是商业扩张中的摩擦,而不是否认自动化会发生。

作者回看十多年前关于卡车司机即将被替代的讨论,再对照 Aurora 9 月公布的计划:2026 年底运营 200 辆无人卡车,2030 年超过 3 万辆。这些是公司目标,不能写成现有车队规模。

Pethokoukis 援引分析报告称,即使达到后一个目标,里程仍只约占 Aurora 所界定长途运输市场的 1.9%;本报未取得该银行报告全文,这个比例保留为作者转述。

他的论证是,制造产能、保险、维护、车辆利用率和接入现有承运网络,会共同决定商业部署速度。Aurora 公告也把扩产、交付和客户协议列为未来目标及风险。

因此,预测就业变化需要交代采用速度和成本,不能从演示能力直接跳到失业人数。这是卡车案例带来的提醒;软件工作可能扩散更快,文章并未测算所有行业的岗位影响。

本批原帖与所用外链已审读

生物医药

Petrelintide 的 9.8%:别把第 28 周和第 42 周混看

FierceBiotech 报道 Roche 与 Zealand 合作的胰淀素类似物 petrelintide 二期数据。中间剂量的第 28 周减重最突出,不能直接拿来和此前第 42 周数字比高低。

报道据新发表论文给出第 28 周结果:5 mg 组平均减重 9.8%,安慰剂为 1.7%,两者相差 8.1 个百分点;7 mg、9 mg 组分别为 9.3%、9.4%。这个数据没有显示剂量越高减重越多。

Zealand 的公告确认 ZUPREME-1 是随机、双盲、安慰剂对照的剂量探索试验,配合饮食与活动干预。主要终点设在第 28 周;公司强调的最高 10.7% 是第 42 周、持续治疗假设下的结果。纳入停药等情况的另一统计口径为最高 10.2%,安慰剂 1.4%。

FierceBiotech 报道,药物组恶心发生率为 20%,安慰剂 6%;公司称在最大有效剂量下未出现呕吐或因胃肠不良事件停药。剂量子组的描述与药物组整体的描述不是一个分母。

项目已启动三期,仍属研究药物。公司公告和报道提供了试验框架与数字,本报未取得论文全文;二期结果也不足以确定长期效果,或凭跨试验比较给不同药物排疗效名次。

本批原帖与所用外链已审读

生物医药

Retatrutide 详细数据:20.8% 的人群与代价

Lilly 公布 TRIUMPH-2 详细三期结果,FierceBiotech 跟进报道。试验针对合并二型糖尿病的肥胖或超重成年人;12 mg 组第 80 周平均减重 20.8%,安慰剂 4.0%。

1152 名受试者被随机分到 4 mg、9 mg、12 mg 和安慰剂四组。研究药物每周注射一次,同时作用于 GIP、GLP-1 和胰高血糖素三类受体。20.8% 采用的是假设持续接受干预、未启动禁用减重治疗的统计口径,不能当作所有真实用药者都会达到的幅度。

12 mg 组有 34.9% 减重至少 25%,安慰剂为 0.8%;平均糖化血红蛋白从基线 7.7% 下降 1.5 个百分点,安慰剂下降 0.2 个百分点。减重与血糖控制是两个结果,不能把其中一个代替另一个。

同一高剂量组腹泻、恶心、呕吐发生率分别为 33.6%、28.0%、15.7%;因不良事件停药为 7.7%,安慰剂 4.9%。Lilly 称多数事件轻至中度,仍需要和效果一起看。

公司计划 2027 年第一季度向美国 FDA 申报,尚未获批。详细结果也已发表,但本报只完成公司公告与报道补读,未取得论文全文;不同人群、时长和统计口径的减重数字不构成头对头比较。

本批原帖与所用外链已审读

生物医药

Genentech 的 AI 改造,连实验台方向都要重新想

FierceBiotech 采访 Genentech CEO Ashley Magargee:AI 与实验室自动化正在影响研究工具和园区规划,但她对人才流失的回答仍是科学能力不会被取代。

具体例子是和 Anthropic 测试代理操作 BCA 蛋白定量实验。Magargee 说,横向实验台原本服务于人的操作动线;自动化后,实验室有多少空间应改成纵向布局,成为团队正在研究的问题。访谈没有提供自动化提速或新药成功率数据。

报道同时交代 gRED 研发部门重组与多位资深科学家离职。CEO 把变化解释为工具进步;这是一方回应,不能据此认定人员调整对研发没有影响。

园区第一阶段拟于 2027—2033 年建设集中研发中心。它纳入 Roche 此前宣布的 500 亿美元美国投资,Magargee 承认其中包括原已计划的投入,也有新投资。因此,大额承诺不能全部算作刚新增的支出,更不是已经完成的建设。

本批原帖与所用外链已审读