Anthropic 为 Claude 推出 Dashboards 和 Motion 两项 beta 功能
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
Anthropic 一年多来首次更新 Claude 使用政策,新增禁止对 Claude 进行持续且不必要的辱骂或残忍行为,违规者可能被警告、限流、限制、暂停或终止访问。公司称该条款不适用于常见的用户不满、反驳、黑暗创作主题或模型测试研究,仅针对极端情况。新政策还把虚假账号与误导性政治内容归入宣传禁令,将武器禁令扩展到软件和无人机武器化,并更明确禁止未经同意的监控。
Amazon Bedrock AgentCore payments 正式可用,为 AI 智能体提供按需付费的托管能力,支持 x402 兼容端点,由基础设施层而非模型执行消费限额。
Ben Affleck 因在多段采访中讲解机器学习、神经网络、Transformer、张量和 GPU 等概念而走红网络,他称自己会写 Python 脚本。他透露曾走访 OpenAI,并于 2022 年创办 InterPositive,通过解冻权重微调开源视频模型、只训练最后的电影质感层,该技术已用于其电影《Animals》的后期制作。
AI 模型众包排行榜 Arena 完成 2 亿美元 B 轮融资,估值达 31 亿美元,较今年 1 月 17 亿美元投后估值在约 10 个月内接近翻倍。
据《金融时报》报道,OpenAI 已告知投资者其年化收入“接近 500 亿美元”,比此前外界报道的接近 700 亿美元低约 200 亿美元。此前 700 亿美元的数字来自 OpenAI 投资者为与 Anthropic 年化收入直接对比而做的推算,两家公司计算年化收入的方式不同,Anthropic 会计入云合作伙伴的销售额,OpenAI 则不计入。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可接受目标而非仅指令,自主规划任务、调用自定义技能与工具并连接企业内部系统。
推荐理由:Google 把 Gemini 从对话助手推进到可自主执行任务的智能体,并给出企业侧接入与管控细节。
一批数学家发表声明,呼吁抵制 OpenAI,起因是 OpenAI 一次性放出 700 多个文件,声称其内部模型解决了 100 多个未解数学问题。菲尔兹奖得主 Terence Tao 在博客转发该声明并提出 Math 2.0 时代,Scott Aaronson 则称之为 Mathocalypse。
推荐理由:数学界对 OpenAI 批量放出 AI 证明的反弹,呈现了 AI 冲击基础研究时学术共同体与实验室之间的张力。
Anthropic 周四更新使用政策,新增禁止干预选举、武器软件、监控以及长期辱骂模型等条款。新政策明确禁止用户持续对模型进行言语辱骂,但仅适用于用户反复恶意攻击且无明确目的的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。政策另设“不要破坏民主进程”章节,禁止用 Claude 运营虚假账号、伪造新闻媒体、欺骗选民或扰乱选举。
USA Today 及其旗下多家地方报纸起诉 OpenAI,指控其未经授权复制“数十万篇”文章用于训练 AI 模型,并索赔超过 2.5 亿美元。诉状称 OpenAI 的商业成功建立在“大规模版权侵权”之上,从未就使用其内容请求许可。
SpaceXAI 宣布以创始企业赞助方身份加入监管 Omarchy 的 Omacom Foundation,并向 David Heinemeier Hansson 的 Linux 项目捐赠价值 150 万美元的 Grok tokens,主要用于加速开发、审查代码和修复 bug。
Anthropic 一年多来首次更新使用政策,新增禁止对 Claude 实施“持续且无必要的虐待或残忍行为”,并明确终止对话仍是主要执行机制,该条款仅适用于用户反复且无明确目的地虐待模型的极端情况,不涉及常见的用户不满、反驳、黑暗创作主题或模型测试研究。
Periodic Labs 联合创始人 Liam Fedus 与 Ekin Dogus Cubuk 在 Latent Space 播客中提出"合成超级智能"(synthesis superintelligence)愿景:以物理实验为环境的强化学习、AI 材料表征、DFT 模拟与高通量实验室,让模型学习做科学的全过程而非只看已发表结果。
AWS 发布基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群。
Oracle 在招聘、工程和运营环节借助 ChatGPT Work 与 Codex,把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
以太坊研究者 Justin Drake 警告,AI 辅助数学最坏情况下可能在数月内破解加密钱包所用的签名系统,他呼吁行业准备"bunker mode",把资金转移到从未签署过交易的地址。Vitalik Buterin 在 X 回复中认同风险,但提醒不要行动过快,称自己因迁移失误损失的钱比被黑客攻击还多。目前 ECDSA 签名方案在实践中尚未被真正破解。
安全公司 Zenity Labs 称,AWS 的 Bedrock AgentCore 存在一串被其命名为 AgentCorruption 的漏洞,攻击者只需对一个公开智能体拥有聊天权限,用一条提示词即可接管同一 AWS 账号和区域内的所有 AgentCore 智能体,读取私密对话、源代码和存储的凭证。
推荐理由:Zenity Labs 披露 AWS AgentCore 的默认权限与隔离缺陷,呈现了智能体平台在权限边界上的系统性风险。
《Gears of War: E-Day》本周正式上线 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能云端游玩,并支持 NVIDIA DLSS 和 NVIDIA Reflex。
LegalOn 将每日 Codex 预估成本削减 65%,同时保持开发速度。该公司按任务类型分配 Astra、Sol 和 Luna 模型,并对预算进行策略性管理。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者将创意转化为精细图像和电影级视频广告。
Nvidia 正押注物理 AI,推出面向机器人公司的全栈安全解决方案,目标指向更安全的 Robotaxi 与人形机器人。该方案已被多家机器人公司采用。
MIT Technology Review 与 Aventine 合作的文章指出,尽管马斯克称 Tesla Optimus 未来能以每台低至 2 万美元自动化几乎所有人类劳动、并预测 2027 年底前向公众发售,但许多机器人研究者对此持怀疑态度。
AVEVA 首席技术官 Arti Garg 提出,工业 AI 正从预测分析转向基础模型、physical AI 与 agentic AI 驱动的新阶段,需以安全、效率与人类监督为核心推进负责任部署。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,官方称其平均运行成本比 Haiku 4.5 低约 75%。
推荐理由:汇总了 Haiku 5.5 的定价、独立评测与 token 消耗数据,可据此判断小模型在智能体工作流中的成本取舍。
微软在两年来的首场线下活动中发布新款 Surface Laptop Ultra,并公布 Windows 11 的一系列改动。
作者在 HuggingChat 中开启 ML-intern 模式,用提示词驱动它完成数据构建、训练、评测和发布,两天内做出六个模型,总计算成本约 103 美元。
推荐理由:作者用 ML Intern 在两天内从零训出六个模型,并公开全部提示词与成本明细,可迁移到自己的训练流程。
OpenAI 捣毁了两起借助 AI 开展的影响力行动,这些行动利用虚假身份的“记者”和一家智库散播地缘政治信息。
Ben Affleck 表示自己从胶片转向数字后对视觉特效产生兴趣,并因此会写"相当糟糕的 Python 脚本"。他解释视觉特效流程多年来一直包含机器学习,早期用卷积神经网络处理 tensor 做边缘检测和特征提取,从而更方便地抠出绿幕画面并替换背景。他将卷积神经网络称为 Transformer 的前身,后者能同时进行更多计算。
Artcraft 从可控 AI 图像视频编辑工具转向一套七款开源应用,复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
Anthropic 发布快速低成本模型 Claude Haiku 5.5,定价为每百万 token 输入 0.10 美元、输出 0.50 美元,与 OpenAI 上月的 GPT-6 Luna 一致,超过 100,000 token 后涨至 0.50/2.50 美元。
推荐理由:作者实测了 Haiku 5.5 的定价、tokenizer 变化与推理档位表现,读者可据此判断它与 GPT-6 Luna 的成本取舍。
Google Research 与 NBER 发布一项为期三个月的专利撰写实地实验,将当时未发布的 Google Labs AI 专利写作助手(现属 Gemini Notebook)随机分配给 11 家知识产权律所的 133 名律师。
推荐理由:三个月专利撰写实验区分了 AI 带来的即时产出提升与无辅助判断力的变化,为理解 AI 对专业能力的影响提供了实证。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:文章给出 Haiku 5.5 在 Bedrock 上的能力定位、成本变化与调用方式,便于判断它在多智能体分层中的位置。
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一并给出,读者可据此判断 Windows 端侧智能体的落地路径。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 在预检索 ACL 过滤之上新增实时 ACL 校验,在查询时直接向权威数据源核实权限,避免依赖可能过期或映射错误的 ACL 数据。
一名男子因利用 1 万个机器人账号和 AI 生成的歌曲刷流媒体播放量、骗取 800 万美元音乐版税,被判处 18 个月监禁。该刷量行为据称使其播放量超过了 Taylor Swift。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与人工修复的失衡,并给出把检测前移到 push 环节的模型方案。
Liquid AI 发布 d1 决策模型家族的两款开源模型 d1-3B 和实验性的 d1-omni-600M。d1-3B 在 Decision Index 0.2.1 上得分 48.57,领先所有 4B 和 9B 模型以及 Decider 35B-A3B 的 47.11,支持文本与图像输入;d1-omni-600M 支持文本加图像或文本加音频。
推荐理由:Liquid AI 开源两款决策模型,给出端侧延迟与七项基准对比,可据此判断小模型做结构化决策的可行性。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,提出 Harnessed Agentic RL 范式,让部署时使用的同一 agent harness 直接参与训练,无需在训练框架内重写智能体。
推荐理由:微软研究院开源 Agent Lightning v1.0,给出真实 harness 参与 RL 训练的设计取舍与实测增益,可据此判断自建智能体训练链路的成本。
AWS 提出 Agentic Value Model 框架,用于替代为 RPA 设计的传统 ROI 模型,从时间节省、异常处理、决策质量和变更韧性四个维度衡量 agentic automation 的价值。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万家客户提供带来源引用的企业级问答,自 2026 年 2 月正式可用以来,其 Discovery Agent 已为客户发现超 10 万条洞察。