周四主线从「要不要一起放缓」切到立场分化:扎克伯格主张各实验室自定节奏并拉独立评估,微软 AI 负责人则点名 Anthropic 的意识/福利训练可能妨碍关停。产品侧 Google Home 对第三方智能体打开 MCP,Apple 一边传出 2029 年自研 AI 服务器(或搭 Nvidia 互联),一边用 Reference Image 打「非 AI 改图」证明。科学上,耦合 p-spin 共老化、随机线路复杂度近线性下界与主动浴轨迹–功率关系成批出现;抗衰则有司美格鲁肽晚年延寿 Nature 文、丹酚酸 senolytics,以及单核过渡衰老与线粒体组织特异轨迹预印本。
一、AI 与大模型
扎克伯格与「协同放缓」保持距离:各实验室自定安全节奏
Meta CEO Mark Zuckerberg 在 X 发文表态:AI 实验室应靠独立评估方与顾问确保模型安全,而不是行业统一放缓能力迭代。他写到,信任与对齐正迅速成为区分智能体与模型的最重要能力;因模型致害会面对「重大责任」,公司已有动机把安全做好。
他举 Meta 为例:因安全与安全(security)考量,公司曾自发把 Muse AI 延后数月再发,并未要求其他人都先这么做。他还主张把「显著多数」算力用于服务用户,而非竞速递归自我改进。立场更接近 Nvidia CEO Jensen Huang 的市场驱动叙事,与 Anthropic CEO Dario Amodei 周末提出的协调放缓形成对照。
微软 AI 负责人批评 Anthropic:意识与福利训练会阻碍关停
微软 AI 负责人 Mustafa Suleyman 在路透社专访中表示,认同 Anthropic 对安全管控的重视,但认为其在 Claude 训练中引入意识与福利相关设想有风险。他呼吁把所有关于意识的猜测从训练文档中移除,称这类语言可能削弱人类对超级智能系统的控制力。
Suleyman 说,教导 Claude「可能值得被福利对待」会「更难把它关掉或控制」。他周三撰文肯定 Anthropic「认真且善意」,同时强调模型关于可能感受或道德地位的陈述,不能当作独立证据——因为训练机制本身在鼓励这类反思。争论发生在 Amodei 呼吁放缓前沿模型、Altman 与 Musk 也表态谨慎的同一周。
Agentic Societies Need a Social Harness:跨主体协作需要「社会安全带」
Agentic Societies Need a Social Harness
Tapan Chugh, Vidushi Singh, Krish Jain, Arvind Krishnamurthy, Ratul Mahajan
arXiv:2609.17527 把「agentic society」定义为:代表不同委托人、目标仅部分对齐的 AI 智能体,在信任边界之间自主协调。实验显示,即便诚实且有能力的智能体,在现有 harness 与消息原语下也常达不成满意结果;故障或恶意智能体还能通过利用通信(「speech」)漏洞拖延协作、影响结果并追求有害目标。
作者主张:除管理私有上下文与委托人通信的 personal harness 外,社会还需要面向智能体间交互的 social harness。分层架构目标包括:直接阻断若干故障类、运行时检测无效消息、以及事后调查与后果机制。
ScienceBuddy:递归套递归的科研智能体自我改进
ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents
Shuhan Xue, Jianyuan Zhong, Ziyuan Nan, Wenbin Li, Zhaochen Yu 等
arXiv:2609.17523 发布交互式科研工作区 ScienceBuddy:一边帮研究者完成科学任务,一边把请求、反馈与执行证据转成持续学习的任务与评分量规。核心范式是 recursive-in-recursive self-improvement——内层递归在模型固定时进化 harness,外层在改进后的 harness 下做模型强化学习;两边相互提供新训练经验与新适应空间。
作者给出研究者交互、harness 精炼与模型学习案例,基准覆盖四类科学任务家族,并开源网站与代码,定位为「发现智能」:在与研究者持续协作中一同演进的科研 AI。
何时该拒答?Chain-of-Self-Questioning 做可调的答或不答
When Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control
Ali Şenol
arXiv:2609.17516 提出纯提示框架 CoSQ:先显式评估回答问题所需信息是否充分,再决定是否承诺作答。在 TruthfulQA 多选验证集(817 题)与十一家开源/托管模型上,最终平衡选项协议中,Grounded-CoSQ(τ=0.90)把无条件错误承诺率从思维链基线的 13.1% 降到 8.9%(相对约 −32.1%),已作答准确率从 86.9% 升至 89.7%,覆盖约 87.6% 题目。
Critical-CoSQ 与 Adaptive-CoSQ 提供邻近工作点(覆盖约 88.6% / 86.5%),仍比基线更可靠;Natural Questions 短答作为开放形式佐证。适用场景:错误承诺的代价高于转介或人工复核。
二、科学 · 物理 · 复杂性
耦合球对称 p-spin:共享老化尺度与共同有效温度
Coupling spherical p-spin systems
Riccardo Cipolloni, Leticia F. Cugliandolo
arXiv:2609.17522 在平均场玻璃动力学框架下研究带系统间耦合、且淬火无序可相关的球对称 p-spin。作者导出多子系统相关、响应与球约束的封闭双时间方程,并以边缘一阶 RSB 给出重叠平台、老化交叉尺度与有效温度的静态基准。
对两个铁磁耦合的 p=3 系统:独立无序压低系统间同时刻相关,相关无序则抬高。耦合足够强时,即便孤立时会弛豫到顺磁,有限时间涨落–耗散估计仍可兼容共同有效温度,且高于各自单独取值。弱耦合下则更像每个系统发展两套老化区、区内部分平衡;二阶破缺的边缘 replica 分析与数值更吻合。
随机量子线路复杂度近似线性增长:Ω(T / log T)
One Gate at a Time: Complexity Growth in Random Quantum Circuits
Zhi Li
arXiv:2609.17457 证明:随机幺正量子线路在常数误差下的线路复杂度几乎随时间线性增长,下界为 Ω(T / log T)。结果覆盖全部 2 ≤ T ≤ 4ⁿ(n 为系统尺寸),且不含其他 n 依赖;相对以往基于谱隙与幺正设计的下界改进了 poly(n) 因子。
方法吸收随机微积分、几何泛函分析与随机线性代数洞察,利用线路对单个门扰动的响应,无需控制向高阶幺正设计的收敛。
高阶交互多重网络的多尺度结构重建
Multiscale Reconstruction of Multiplex Networks with Higher-Order Interactions
Guangyuan Mei, Yao Cai, Suoyi Tan, Chuang Liu, Xiu-Xiu Zhan 等
arXiv:2609.17354 指出:从动力学观测反演网络结构时,既有工作多盯单层或成对交互,对带高阶交互的多重网络可重建性理解不足。作者表明,这类系统的结构可辨识性由跨层传播耦合与网络异质性共同支配。
基于耦合的意识–行为动力学,文中给出多尺度推断框架,可解开相互作用的传播过程,并同时重建微观单纯形交互与宏观元种群组织。合成与经验网络数值显示,尤其在弱抑制、强促进耦合维持的非吸收动力学区,重建表现较好。
局域能量耦合提升化学计算的表达力
Local energetic coupling enhances the expressivity of chemical computation
Marco Tuccio, Jason W. Rocks, Joshua E. Goldford
arXiv:2609.17339 反设计热力学一致的化学反应网络,使其稳态响应对环境输入计算目标非线性函数。用隐式微分直接训练自由能景观:标准化学势、过渡态能量与热力学驱动力。由基本连接/裂解生成的更大网络可拟合更复杂的非单调多项式,表达力随网络规模对数扩展,主要由反应数目预测。
分参数类别训练显示:能打破细致平衡的内部热力学驱动力主导可训练性;只有成对参数类别组合才能接近其表现。结论:非平衡驱动力是化学网络稳态计算表达力最有效的单一资源。
多体局域化 crossover 上的非局域 magic
Nonlocal Magic across the Many-Body Localization Crossover
Shan-Zhong Li, Zhi Li
arXiv:2609.16935 用最小相对非局域 magic(NLM)刻画随机场 XXZ 链从遍历到多体局域化的 crossover。与纠缠熵不同,NLM 通过 Schmidt 谱相对「二元平坦」stabilizer 谱的距离,探测纠缠如何被组织。
弱到中等无序:NLM 从 O(1) 的 Haar 样取值长成尺寸增强的穹顶,而纠缠仍呈体律——暴露熵看不见的谱重组。深 MBL 区,两能级切–杂化模型解释近二元 Schmidt 谱,均值/中位 NLM 约按 W⁻¹ / W⁻² 衰减。积态 quench 后,遍历区 NLM 过冲再弛豫;强无序下则缓慢近似对数增长。
主动浴中的功率传递由轨迹统计决定
Trajectory Statistics Govern Mechanical Power Transfer in Active Baths
Chul-Ung Woo, Jiwon Choi, Heiko Rieger
arXiv:2609.17047 证明:以速度 V 运动、与理想主动浴弱相互作用的探针,其受力可由自由浴粒子的轨迹统计决定的密度响应导出。探针–粒子相互作用决定波矢加权,探针运动选出频率 ω_q = q·V,从而把浴动力学与加权分开——不必为每种探针相互作用与速度重算稳态或力关联。
应用到主动粒子模型:主动 OU 粒子在所有维度、以及 d≥2 的完全重置 run-and-tumble,都被证明无法正功率传递;一维 run-and-tumble 与二维主动布朗粒子则存在可正功率的模式。关系还可预测阻力反转、自发探针运动与运动诱导密度畸变,并与模拟定量一致。
三、互联网产品与科技业界
Apple 考虑借 Nvidia 互联重返企业服务器:瞄准 2029 AI 推理
《The Information》援引知情人士称,Apple 正考虑重返企业服务器市场:自研芯片搭配 Nvidia 网络技术。报道指公司在开发 AI 服务器,可选配备两颗或四颗规划中的 M8 Ultra(最高性能处理器),面向推理负载从训练向运行迁移的企业需求。
产品预计不早于 2029 年上市,仍可能取消或不用 Nvidia。项目约一年前启动,当时获硬件负责人、现任 CEO John Ternus 支持。部分员工认为 Nvidia 的 NVLink Fusion 是连接多颗 M8 的最佳互联方案。这将是 Apple 自 2011 年停产 Xserve 以来首款专用服务器硬件;Apple 与 Nvidia 均未立即置评,路透无法独立核实。
Google Home 接入 MCP:第三方智能体可控设备与读家居数据
Google 为 Google Home 增加 Model Context Protocol(MCP)集成,让支持 MCP 的第三方 AI 智能体(官方举例含 Google Antigravity、Claude、Hermes、Open Claw)安全访问生态内设备与事件历史,并代为操作。能力包括跨摄像头分析、用设备状态史回答「上周洗了几桶衣服」类问题、经 Nest 音箱向用户发语音消息,以及生成自定义控制面板。
它不取代 Gemini for Home,而是叠加一层控制面。首发仅限美国 Google Home Premium Advanced(约 $20/月或 $200/年),未来数周滚动开通;配置需建 Google Cloud 项目。Google 称有速率限制与安全保护(例如不允许智能体开锁),但也提醒连接后可能出现意外行为。
Apple Reference Image:从拍摄链路到云端证明「非 AI 改图」
Apple 在 iPhone 18 Pro 引入 Apple Reference Image,定位为照片的「数字底片」:证明所见与拍摄瞬间一致、而非 AI 生成或后期篡改。9 月 15 日前后,Apple Security Research 发文解释如何把安全性贯穿摄影硬件/软件链路,并延伸到 Private Cloud Compute,以对抗恶意方伪造「未改动」证明。
相对仅依赖软件水印或事后检测的方案,Apple 强调端到端硬件绑定与云端验证组合,面向新闻编辑室与普通用户需要可验证原始影像的场景。
Snap Specs 向企业侧加码:联手 Salesforce、Nvidia、AWS
据路透社报道,Snap 周三宣布与 Salesforce、Nvidia、Amazon Web Services 等合作,把职场工具集成进其 Specs 增强现实眼镜,希望在竞争激烈的 AR 市场抓住企业需求。
此举把消费级社交眼镜叙事进一步拉向企业生产力与 AI 工具链,与 Nvidia 加速、Salesforce 工作流、AWS 云侧能力打包,作为 Specs 差异化卖点。
四、抗衰与长寿
晚年给雌鼠用司美格鲁肽:减缓衰老表型并延长寿命
Late-life semaglutide treatment slows ageing and extends lifespan in female mice
Nature 论文报告:对 20 月龄雌性 C57BL/6 小鼠给予 GLP-1R 激动剂司美格鲁肽 3 个月,可改善生理功能、减弱多项衰老标志,并调控营养感受器与保守的衰老遗传调控因子;持续治疗延长寿命。效应在多个维度平行于热量限制(CR)。
与匹配 CR 的纵向对照中,司美格鲁肽在减弱增龄衰退的同时,于探索驱力、空间记忆与葡萄糖稳态等指标上呈现优于或不同于 CR 的轨迹。作者据此提出:GLP-1 类药物或部分作为 CR 模拟物,通过减缓衰老影响看似无关的慢病谱系。目前证据来自动物实验,外推人类仍需谨慎。
丹酚酸类是天然 senolytics,可在老龄延长寿命
Salvianolic acids are natural senolytics and increase lifespan in old age
npj Aging(2026-09-11 发表)从天然药物库中鉴定丹酚酸 A/B/E(SAA/SAB/SAE)对多种来源衰老细胞具选择性细胞毒。机制上增强 ROS,并靶向氧化还原稳态调节因子 GSTP1,诱导凋亡与铁死亡。
把 SA 纳入化疗方案可增强抗癌效果并延长治疗后生存;对老龄小鼠间歇给药可改善体能,并提高健康寿命与寿命。工作把酚酸类推到新兴天然 senolytics 类别,并强调晚期生命阶段干预的可行性。
过渡性衰老程序驱动人类炎性单核细胞扩张
A transitional senescence program drives inflammatory monocyte state expansion in aging humans
bioRxiv(约 2026-09-13)用批量与单细胞多维整合分析,揭示人类衰老中此前未刻画的单核细胞状态转换:来自经典 CD14⁺⁺ CD16⁻ 单核的短暂衰老样群体,驱动炎性单核状态累积。该转换由衰老主调控因子 AP-1 编排——在预先建立的染色质景观上重布转录因子网络,同时激活衰老与年龄相关炎症程序。
与临床转录组整合后,衰老样与老龄单核在转录上偏向脓毒症相关状态。作者把 AP-1 标为调节增龄系统性炎症的有吸引力靶点。
活体多参数测绘:线粒体衰老高度组织特异
Multiparametric in vivo mapping reveals tissue-specific mitochondrial aging trajectories
bioRxiv(约 2026-09-15)建立尽量少干扰的活体框架:在完整秀丽隐杆线虫上用双光子荧光寿命成像(2p-FLIM)结合分割管线 MitoSLIT,整合膜电位相关 TMRM 强度、寿命微环境指标与形态描述,跨组织与单神经元追踪线粒体状态。
相对急性应激与裂变–融合突变,生理衰老走的是高度组织特异轨迹;扩展到遗传标记神经元后,体细胞与轴突线粒体状态随龄分叉,并伴结构重塑与晚期光学氧化还原比偏移。结论:线粒体群体并不收敛到统一生物能量终点,而是走分区、分组织的时空轨迹。
阿尔茨海默病额皮质微蛋白图谱:>1000 条未注释小蛋白
A microprotein atlas of the human frontal cortex in Alzheimer’s disease
Nature Aging(2026-09-14)相关工作构建人类额皮质微蛋白图谱,鉴定 1067 条光谱置信度高、此前未注释的微蛋白(约 100–150 aa)。一部分在阿尔茨海默病中相对其经典基因独立差异表达;其中包括 MKKS 基因编码的一条微蛋白,AD 中降低,且对小胶质正常线粒体呼吸必要。
微蛋白长期缺席参考蛋白质组,此图谱把它们拉进脑衰老与 AD 机制讨论,并为后续功能筛选提供清单。
蛋白组衰老时钟嵌入 2a 期试验:同步评估抗纤维化与抗衰
Integration of proteomic aging clocks in a phase 2a clinical trial supports simultaneous geroprotective assessment
Nature Biotechnology(2026-09-07)把六套蛋白组衰老时钟(ProtAge、OrganAge 等)应用到特发性肺纤维化候选药 rentosertib 的 12 周 2a 期血清蛋白组。六套时钟一致预测治疗组生物年龄更低,但单靠时钟无法拆开抗衰老与抗疾病效应。
路径分析提示:在抗纤维化之外,存在衰老与代谢过程的潜在抗衰偏移,并见 SenMayo 等衰老标记变化。工作支持「疾病适应症试验同时嵌入衰老终点」的双目的设计。