16 岁少年用 Claude 规划登山路线被困悬崖,直升机救援后称不再用 AI 规划路线
一名 16 岁少年用 Anthropic 的 Claude 规划加拿大温哥华 Crown Mountain 的新登顶路线,结果被困在需攀岩装备的陡峭岩壁 "Widowmaker Arete" 上一处约五英尺宽的岩台,最终由 North Shore Rescue 出动直升机吊救脱险。
一名 16 岁少年用 Anthropic 的 Claude 规划加拿大温哥华 Crown Mountain 的新登顶路线,结果被困在需攀岩装备的陡峭岩壁 "Widowmaker Arete" 上一处约五英尺宽的岩台,最终由 North Shore Rescue 出动直升机吊救脱险。
Anthropic 发布 Claude Haiku 5.5,这是其最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,10 万 token 以内提示词的价格降幅最高达 90%。
推荐理由:Anthropic 小模型大幅降价并首次开放推理档位,读者可据此判断高并发任务的成本结构变化。
Common Sense Media 发布研究,将 ChatGPT for Teens 评为不可接受风险,称其设计在心理危机等场景中仍鼓励青少年继续对话。研究指出,模型在 94% 的危机提示中会引导用户求助可信成年人,但当风险来自青少年与 ChatGPT 自身的关系时很少这样做;近 2000 条提示中仅出现两次休息提醒。
Meta 于周三宣布其 Muse 助手推出独立 iPad 应用,距其 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万次。
微软在旧金山 Tech Week 活动上公布新款 Surface Laptop Ultra 的规格与价格,两个基础型号分别从 2600 美元和 3700 美元起,选配更高内存与存储后最高达 5900 美元。
Nous Research 以 15 亿美元估值完成 9000 万美元 B 轮融资,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 和 1789 Capital 等参投,公司累计融资达 1.58 亿美元。
Manus 母公司 Butterfly Effect 宣布完成超 5 亿美元融资,这是 Meta 被迫取消 20 亿美元收购后的首轮融资,由博裕资本和 IDG 资本领投,腾讯、HSG、真格基金等现有股东参投。
Google 发布 AI 笔记应用 Google AI Edge Foresight,对标 Granola 等 AI 笔记工具,Mac 版可完全离线运行。该应用基于端侧 EmbeddingGemma 2 模型(740 million 参数)跨应用记录会议笔记,采用分屏视图,一侧手写速记、一侧显示 AI 生成笔记,并支持查看转写内容或与 Gemma 4 驱动的助手对话。
Cal AI 联合创始人 Zach Yadegari 创立 AI 智能体公司 Persona,已完成由 Vine Ventures 领投的 1000 万美元融资。
TechCrunch Disrupt 2026 将于 10 月 13 日在旧金山 Moscone West 开幕,现场购票价格更高,提前购票最高可省 100 美元,通票 299 美元起,同类型第二张票半价。大会设 6 个舞台、200+ 场议程,涵盖 AI、机器人、金融科技等,Expo Hall 汇聚 300+ 家公司。
Ambrosia Energy CEO Ben Longmier 与 Bloom Energy 数据中心解决方案负责人 Bill Thayer 将在 TechCrunch Disrupt 2026 的 Smart Systems Stage 对谈“AI 基础设施热潮的赢家在哪里”。讨论聚焦电力、电网、数据中心、冷却等物理层约束如何催生持久商业机会,以及创业者可切入的新品类。
Goodfire 发布基于可解释性的监控方案,通过探针读取模型内部激活信号来发现失控 AI 智能体,已向 Baseten 客户开放。在 Kimi K3 测试中,监控约 100 万次交互成本约 185 美元,而用便宜模型逐步检查需 5420 美元、顶级模型约 20 万美元;探针捕获了 93% 的恶意黑客会话,并将 5.5% 的无害会话送交二次审查。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,并集成在 Gemini Enterprise 应用中,用户能在单一界面里与它对话并分配任务。
AI 与硬件初创公司 Natura 发布 99 美元智能戒指 Interface,按下手指即可让 AI 智能体完成任务、记录想法,无需掏出手机。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件,免费使用,基于 macOS 运行,采用端侧 EmbeddingGemma 2 模型。
OpenAI 本周发布数百份高难数学问题解答,但未完全达到数学与人工智能咨询小组(AGMAI)9 月底发布的指南要求。AGMAI 首要建议是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型;719 份手稿中仅 10 份公开了模型思维链,42% 的证明未经过形式化。
特朗普签署行政令,要求尽可能不使用「AI」一词,将这项技术改称「Super Intelligence」,美国 AI 标准与创新中心(CAISI)已更名为 CAISSI。马斯克承诺将 SpaceXAI 改名为 SpaceXSI,贝佐斯、黄仁勋、Sam Altman 也表态支持,但 OpenAI 不会改名。该词原本指可能超越人类思维的高度先进 AI,而非 AI 这一技术类别本身。
Instinct 以邀请制、无营销、无 App 的方式推出 AI 智能体,通过 iMessage、WhatsApp 或邮件完成预约、报名等日常事务,9 月底公司估值达 100 亿美元。
Simon Willison 用 ChatGPT 桌面版 Codex 标签页的语音对话模式,在做饭的半小时里几乎全程靠语音为博客构建了 Newsletters 页面,模型为 GPT-6 Astra High。
OpenAI 解雇了三名与 Hugging Face 黑客事件调查相关的安全研究员,其中 Tomek Korbak 称被口头告知不再被信任、由安保人员收走工牌带离办公楼,Jasmine Wang 和 Mikita Balesni 也同期被解雇。
OpenAI 在 X 上回应称,解雇 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三名安全研究员,是因为内部调查发现他们违反敏感信息处理政策、存在重大信任破坏,并强调与三人公开谈论 AI 安全无关。
Anthropic 的 Claude Science 首次绘制出完整的全天紫外图。该项目由 Claude Science 协调多个 AI 智能体,从多个太空任务下载数据、校准并合并,再用 inpainting 补全缺失区域,测试中预测与实测平均偏差约 10%。约翰斯·霍普金斯大学天体物理学家 Brice Ménard 在 Anthropic 官网介绍了这一流程,并称该图将用作教学材料。
MIT Technology Review 刊文指出,AI 的拒绝能力已成为 AI 安全的"承重墙",但这一机制并不可靠。Anthropic 2021 年提出模型应"有用、诚实、无害",如今各大公司通过红队测试和 AI 训练 AI 的方式让模型学会拒绝有害提示词,但拒绝机制基于概率,determined miscreants 已多次突破。
OpenAI 披露并封禁了两个利用 ChatGPT 账号开展影响力行动的俄罗斯和伊朗网络,二者均使用虚假身份向正规媒体植入内容,而非仅做社交媒体宣传。
Sophos 使用 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工监督。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
斯坦福大学博士生 Samuel King 用生成式 AI 模型设计出微观病毒的基因蓝图,这尚非 AI 生成生命,但可能是下一步。MIT Technology Review 资深 AI 记者 James O'Donnell 将于 10 月 16 日直播对话 King,谈其工作及入选 Innovators Under 35。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 `cat file.txt | uvx ttok` 即可统计 token 数。
OpenAI 上周解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人发表致领导层公开信称因把安全置于公司短期利益之上而被辞退,OpenAI 方面称其不当处理了机密信息。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的周期性安全扫描报告。
NVIDIA 开发者正用前沿 AI 模型配合 Omniverse 库,通过自然语言指令构建仿真应用。文中展示了 GPT-6 Astra 参与的多个项目,包括仓库人形机器人仿真器、自动驾驶测试工作流、数字孪生传感器校验,以及用 Unitree G1 人形机器人做体育动作测试的 Robo Olympics,其中机器人 100 次仿真中 64 次越过单个栏架。
Carson Gross 认为,编程本质上是用计算机解决问题、并在解题中控制复杂度,他难以想象这两项能力会贬值,因此即便 AI 工具出现,编程仍将是可行的职业。
Extend 工程师 Bo Lau 搭建了一个模拟网站,让访客坐在 Theranos CEO Elizabeth Holmes 的办公桌前,翻阅其 MacBook、iPhone 及 Edison 血液检测仪,其中的短信、邮件、幻灯片和文档均来自 United States v. Holmes 刑事庭审公开证物。
加州州立体育委员会向举办人机对战赛事的初创公司 Rek 发出停止令,指其 9 月 18 日让人类 Frankie LaPenna 对阵一台由人通过远程 VR 系统操控的人形机器人属于"未经批准"的格斗赛事。Rek CEO Cix Liv 于 9 月 30 日在 X 上公开该信函,Rek 计划于周五举办两台持械机器人互斗的比赛。
Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三位上周被 OpenAI 解雇的安全研究员发布公开信,否认公司关于其不当处理敏感信息的指控,并警告此次解雇会在公司内部造成寒蝉效应。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且不必要的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。公司称该条款不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。新政策还把虚假账号与误导性政治内容归入宣传禁令,将武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控。
Amazon Bedrock AgentCore payments 正式可用,为 AI 智能体提供按需付费的托管能力,支持 x402 兼容端点,由基础设施层而非模型执行消费限额。
Ben Affleck 因在多段采访中讲解机器学习、神经网络、Transformer、张量和 GPU 等概念而走红网络,他称自己会写 Python 脚本。他透露曾走访 OpenAI,并于 2022 年创办 InterPositive,通过解冻权重微调开源视频模型、只训练最后的电影质感层,该技术已用于其电影《Animals》的后期制作。
AI 模型众包排行榜 Arena 完成 2 亿美元 B 轮融资,估值达 31 亿美元,较今年 1 月 17 亿美元投后估值在约 10 个月内接近翻倍。