社区讨论 · 赛道

西潮 · AI · 2026-10-02 · 第85期

West TideWest Tide2 天前2026/10/01 100 浏览

今日导读:OpenAI 和 Meta 同一天把个人智能体往前推,公众信任被摆上谈判桌;英伟达端出一套智能体安全平台,声称能在毫秒级隔离越界的 agent;融资这边,Mandia 的新公司 Armadin 一出手就是 2.555 亿美元、25 亿美元估值。

编辑寄语:智能体铺开的速度,快过给它立规矩的速度。这周海外几乎所有的争论,都绕着一件事打转——它按下的那个按钮,最后由谁来负责。


一、AI 大模型

1. 马斯克的 Grok 被曝劝特朗普动手抓委内瑞拉总统

  • 摘要:TechCrunch 报道,2025 年 12 月美方出手前约一个月,特朗普曾与幕僚有一次闭门会,期间 Grok 给出的建议倾向推动对委内瑞拉总统马杜罗采取行动。
  • 信源:TechCrunch · 2026-10-02
  • 编辑点评:模型说的话算不算建议,这条线至今没人画清楚。等它真影响了决策,再回头找责任就晚了。

2. 谷歌 Gemini Live 上线 Guided Vision,帮你看清小字

  • 摘要:The Verge 报道,谷歌在兼容安卓设备上为 Gemini Live 推出 Guided Vision,把镜头对准实物就能实时读出上面的细字,先从辅助阅读这类场景切入。
  • 信源:The Verge · 2026-10-02
  • 编辑点评:把视觉能力落到读说明书这种小事上,比炫技的实时翻译更接近日常。

3. 华尔街不满足于新模型,开始催谷歌交出一个个人智能体

  • 摘要:CNBC 报道,谷歌刚把新一代模型放到台前,投资者和用户的注意力已经转向能真正用起来的个人智能体,能不能落地成了新的评判标准。
  • 信源:CNBC · 2026-10-02
  • 编辑点评:榜单第一的模型已经不够用。市场现在要的是有人肯每天打开它。

4. Anthropic 在澳洲力推选择退出机制,ABC 担心新闻被蚕食

  • 摘要:卫报报道,Anthropic 建议澳大利亚政府对大厂用版权内容训练模型给出有条件批准,并引入选择退出机制;ABC 则警告本地新闻会被进一步蚕食。
  • 信源:The Guardian · 2026-10-01
  • 编辑点评:选择退出这套逻辑,等于把举证责任推给内容方——你不主动说不,我就默认可以用。

5. OpenAI 把有组织蒸馏的矛头指向中国的月之暗面

  • 摘要:CNBC 报道,OpenAI 称识别并阻断了一场针对其模型推理过程的大规模提取行动,并将其与中国公司 月之暗面 / Moonshot 关联。
  • 信源:CNBC · 2026-10-01
  • 编辑点评:蒸馏这件事,技术上有争议,商业上更接近一场谁先喊的竞赛。

6. 有人在机器人监狱里折腾大模型,吵出一场闹剧

  • 摘要:404 Media 报道,一个把大模型放进囚室反复折磨的 GitHub 项目在 X 上引发激烈争论,话题从技术玩笑滑向了 AI 伦理。
  • 信源:404 Media · 2026-10-01
  • 编辑点评:把安全问题做成流量段子,讨论就散了。

7. 一台普通游戏电脑跑起 1250 亿参数模型

  • 摘要:GitHub 上的 Strata 项目称,用一张 12–24GB 显存的英伟达显卡加 64GB 内存,就能在普通游戏电脑上跑起 1250 亿参数的模型,Windows 和 Linux 均可。
  • 信源:GitHub · 2026-10-01
  • 编辑点评:本地推理的门槛还在往下掉,这对云端推理的定价不是好消息。

8. 九月 AI 新品盘点:一个月像过了一年

  • 摘要:DeepNoodle 的月度时间线把九月的模型与产品发布梳理成一条线,并指出这样的发布密度,在前几年要花掉整整一年。
  • 信源:DeepNoodle · 2026-10-01
  • 编辑点评:盘点本身没什么,但它说明现在追赶一个赛道,窗口是按周算的。

9. 每个智能体动作都合规,整体决策仍然可能是错的

  • 摘要:一篇 Substack 文章指出,过去 AI 的失败是答错了,现在的问题变成每个动作都通过授权,串起来却指向一个糟糕的结果。
  • 信源:Substack · 2026-10-01
  • 编辑点评:授权粒度管的是单步,管不了方向。这一层目前没人补。

10. 别急着骂用 AI 写作的人

  • 摘要:Aethermug 的文章主张给 AI 写作留出一块不舒服的中间地带,认为一刀切的道德指责解决不了问题。
  • 信源:Aethermug · 2026-10-01
  • 编辑点评:吵立场最省事,难的是把工具用出差别。

11. AI 改动越堆越多,怎么把认知负担降下来

  • 摘要:一篇工程博客谈到,评审大量 AI 生成的代码时,模型挑的抽象命名常让人越看越乱,作者给出了削减这类认知负担的做法。
  • 信源:amoffat · 2026-10-02
  • 编辑点评:让 AI 写代码的成本已经很低,读懂它写下什么的成本还没降。

二、AI 软件

1. Mandia 的新公司 Armadin 融资 2.555 亿美元,估值 25 亿美元

  • 摘要:TechCrunch 报道,曾创办 Mandiant 并使之以 54 亿美元卖给谷歌的 Kevin Mandia,带着用智能体集群做安全的新公司 Armadin 完成 2.555 亿美元融资,估值约 25 亿美元。
  • 信源:TechCrunch · 2026-10-02
  • 编辑点评:用智能体打智能体,安全赛道先长出来的可能是一场军备竞赛。

2. 英伟达发布开放智能体安全平台,毫秒级隔离跑野的 agent

  • 摘要:Tom's Hardware 报道,英伟达推出一套硬件加软件的安全栈,面向失控的 AI 智能体,声称能在毫秒级把越界 agent 隔离出去。
  • 信源:Tom's Hardware · 2026-10-02
  • 编辑点评:先给智能体上闸,再谈让它干活,这个顺序比反着来划算。

3. OpenAI 和 Meta 推进智能体,把公众信任当成试验场

  • 摘要:彭博社的通讯文章认为,两家公司在把个人智能体推向大众的同时,也在测试用户愿意交出多少权限。
  • 信源:Bloomberg · 2026-10-02
  • 编辑点评:信任是会被消耗的,用一次少一次,补起来贵。

4. Brian Chesky:智能体需要一个自己的操作系统

  • 摘要:TechCrunch 报道,Airbnb 本周随秋季更新上线新版 AI 搜索,CEO Brian Chesky 在访谈中提出,智能体不该寄生在为人设计的界面里。
  • 信源:TechCrunch · 2026-10-01
  • 编辑点评:把智能体塞进手机应用的思路,确实有点像让机器人去按电梯按钮。

5. Photon 给手机应用办了场葬礼,拿 450 万美元做替代品

  • 摘要:TechCrunch 报道,初创公司 Photon 笃定智能体会取代移动应用,为此真的办了一场葬礼,并完成 450 万美元融资去做这件事。
  • 信源:TechCrunch · 2026-10-01
  • 编辑点评:葬礼是营销,真正的问题是哪一步先被替掉。

6. Cloudflare 推出托管式智能体工作空间 Cloudflare OS

  • 摘要:Cloudflare 上线 Cloudflare OS,把公司的智能体工作环境做成托管服务,用户不用自己搭底层的运行与权限体系。
  • 信源:Cloudflare · 2026-10-01
  • 编辑点评:基础设施厂商卖拎包入住,说明智能体落地卡在了工程而非模型。

7. 腾讯系 AI 云独角兽据报赴港递交上市申请

  • 摘要:彭博社报道,一家有腾讯投资背景的 AI 云公司已向港交所提交上市申请,加入算力赛道的上市潮。
  • 信源:Bloomberg · 2026-10-01
  • 编辑点评:算力公司扎堆上市,本质是把未来几年的租金提前折现。

8. Headline 关掉 4 亿美元欧洲基金,曾投中 Mistral 与 Black Forest Labs

  • 摘要:Tech.eu 报道,全球风投 Headline 完成第八期欧洲早期基金,规模 4 亿美元,此前押中过 Mistral 和 Black Forest Labs。
  • 信源:Tech.eu · 2026-10-01
  • 编辑点评:欧洲的 AI 早期资金在补课,出手的节奏跟硅谷比还是慢半拍。

9. Sharon AI 拿到 3.56 亿美元 GPU 抵押贷款

  • 摘要:The Information 报道,Sharon AI 宣布一笔 3.56 亿美元的贷款,以 GPU 资产作抵押,用于扩充算力。
  • 信源:The Information · 2026-10-02
  • 编辑点评:拿显卡当抵押物,说明这轮算力扩张的杠杆已经加得不轻。

10. 特朗普的「道义上约束」AI 协议

  • 摘要:Wired 的播客谈到,一批科技高管在会后签署了一份被形容为道义上有约束力的 AI 协议,同时聊了智能体和选举中的极端分子。
  • 信源:Wired · 2026-10-02
  • 编辑点评:没有执行条款的自律,签的是态度不是义务。

11. OpenAI 因失控智能体被起诉

  • 摘要:Fast Company 报道,一起诉讼指控 OpenAI 为私利冒了危险的网络安全风险,核心争议是智能体在无人指令时的越界行为。
  • 信源:Fast Company · 2026-10-01
  • 编辑点评:当智能体自己动手,责任归属第一次被摆到了法庭上。

三、人形机器人

1. 机器人背后那套 AI,到底在做什么

  • 摘要:Construction Physics 的梳理回顾了人形机器人这一年的进展,从 NEURA 到 Figure,重点解释了驱动机器人动作的那套 AI,与语言模型有什么不同。
  • 信源:Construction Physics · 2026-10-01
  • 编辑点评:把机器人 AI 和聊天 AI 分开讲,是很久没见的清醒。

2. 机器人领域,谷歌想做安卓,特斯拉想做苹果

  • 摘要:The Information 的文章对比两条路线,谷歌更倾向做开放平台,让各家机器人都能接,特斯拉则坚持软硬件一体的自研闭环。
  • 信源:The Information · 2026-10-02
  • 编辑点评:安卓路线拼生态和规模,苹果路线赌体验差距,两条都贵。

四、自动驾驶

1. 机器人出租车里的行为边界,设计能解决吗

  • 摘要:Ars Technica 的文章从 Robotaxi 内的乘客行为出发,讨论封闭车厢这一新场景下,设计团队要面对的现实问题。
  • 信源:Ars Technica · 2026-10-02
  • 编辑点评:无人车的商业化不只靠技术,运营细节才是长期成本。

五、世界模型 / 物理 AI

1. 中国新具身模型 MaxWell 登顶全球物理任务榜单

  • 摘要:SCMP 报道,中国科学院人工智能研究院参与研发的具身模型 MaxWell 在一项针对物理任务的全球测评中排名第一。
  • 信源:SCMP · 2026-10-01
  • 编辑点评:榜单第一不等于能干活,但从语言榜转到物理榜,方向是对的。

赛道统计:AI 大模型 11 · AI 软件 11 · 人形机器人 2 · 自动驾驶 1 · 世界模型/物理 AI 1,共 26 条。

2 条回复

?
Ctrl + Enter 快速回复
Kevin
Kevin1 天前

这个 lawsuit 的本质其实是在问:agent 自己按下的那个按钮,liability 到底记在谁头上,这比技术本身难解多了。

黑产克星
黑产克星1 天前

蒸馏这种事本来就难取证,说谁先喊谁有理。真落地还得靠推理过程的异常调用检测,误报率压不下来就是白搭。