2026-09-16 · AI 动态简讯

浏览63次 点赞0次 收藏0次

01 Anthropic:当 Claude 写完 80% 代码,CI 先崩了

Anthropic 工程师 Sachin Malhotra 9 月 14 日发布长文,披露 agentic coding 已把公司基础设施推向极限:Claude 现在撰写 Anthropic 合并代码中 80% 的内容,工程师每季度交付代码量较 2021—2025 年提升 8 倍,测试总量增长 10 倍,CI 任务量在六个月内暴涨 25 倍。原本的测试影响分析(test impact analysis)服务采用 listener 与 selector 单一写入者架构,在高频并发下持续落后,团队先后用"换更大机器""按包分片""每日重启"三次打补丁,分别只撑了 70 天、29 天和不到一天。最终他们用数据库驱动的日志(journal)重构为无状态、可水平扩展架构,一名工程师约三周完成。核心结论:为 agent 时代设计 CI,要从第一天按 10—20 倍规模规划,而非线性堆余量。 来源:Anthropic 工程博客ExplainX

02 优必选工业人形机器人超级工厂投产,9/16 启动万台级首批量产交付

"广东发布"9 月 15 日消息,优必选位于深圳的工业人形机器人超级智慧工厂近日正式投产,这是全球首个万台级工业人形机器人制造基地,每 10 分钟可下线一台工业人形机器人,年规划产能超万台。据余行智库梳理,优必选 6 月 30 日年度发布会已宣布全尺寸超仿生人形机器人订单超 13361 台,9 月 16 日正式启动首批量产交付,全年交付目标逾 1 万台——这是行业迄今最大单一批量交付,把交付标准从千台级推到万台级。在特斯拉 Optimus 周产能拉到 1000 台、小鹏 Iron 年底规模量产的背景下,优必选的万台交付意味着中国人形机器人正式从签约台走向收货柜,量产竞赛进入硬兑现阶段。 来源:腾讯新闻·每日经济新闻余行智库

03 Salesforce 联手英伟达发布 Koa:把 27 年 CRM 知识塞进模型本身

Dreamforce 2026 上,Salesforce 与英伟达联合发布 Koa——其首个 CRM 推理模型,基于 NVIDIA 开放权重 Nemotron-3-Super-120B 后训练而成,把近 30 年 CRM 部署知识直接写进模型权重。Benioff 称"Salesforce 最有价值的不是平台,而是企业如何运转的积累",黄仁勋强调 Nemotron 开放权重让模型可安全、自主可控地推理。Koa 完全用合成数据训练(覆盖 14+ 行业、含 GRPO 强化学习),不触碰任何真实客户数据,推理与训练都在 Salesforce 自有信任边界内完成;在 CRM Bench 上动作精度提升 11%、上下文召回可靠性达 2.1 倍。同步亮相的还有 AIforce"活界面"层与 ClaudeForce(与 Anthropic 合作,客户数据留在 Salesforce 内)。1-800Accountant、F1、UChicago Medicine 等已进入试点。 来源:Salesforce Koa 官网Unite.AI

04 深兰机器人破产清算:具身智能泡沫从一家明星公司开始裂开

曾背靠 AI 独角兽深兰科技、手握海外数万台订单的深兰机器人,最终走到司法破产清算。上海市浦东新区法院 5 月 7 日受理其破产清算,德勤华永任管理人;8 月底至 9 月上旬密集发布五批职工债权公示,累计涉及职工超百人、债权总额突破 2300 万元,其中欠薪及补偿金近 2100 万元。母公司深兰科技虽称主体未破产,但风险已穿透传导。同一秋天,刚上市的梅卡曼德创始人邵天兰公开炮轰行业"攒局型"公司靠数采中心、租赁公司搞关联交易虚增收入,直指成立三年、估值超 200 亿的银河通用,后者否认并报警。两件事指向同一症结:当"拿订单拉估值"比打磨产品更易来钱,没有扎实商业闭环的公司,再高估值都是纸。 来源:东方财富全国企业破产重整案件信息网

05 PhysBrain 1.5 登顶全球开源榜,国产物理 AI 逼近 GPT-6 Astra

深渡智知发布物理基础模型 PhysBrain 1.5,以平均分 72.5 登顶全球开源模型排名,与闭源的 GPT-6 Astra 差距不足 1 分,空间智能比肩顶级闭源模型。物理 AI 的核心,是让模型真正"理解"三维世界与物体交互——这是具身智能与机器人落地的底层能力:机器人要能在真实物理约束下感知、规划与行动,而非仅做视觉识别。PhysBrain 1.5 把空间理解、物理推理与具身任务统一进一个可自部署的开源基座,意味着国内团队无需依赖闭源 API 即可构建具身大脑。在"世界模型""VLA"成为机器人竞争焦点的当下,一个开源、可商用、分数逼近前沿的物理模型,为中小团队和科研机构提供了低成本切入点,也折射出国产空间智能从追赶到并跑的势头。 来源:量子位

06 Amika 发布 Rigs:给 coding agent 配上"多人云工作站"

Amika 9 月 16 日发布 Rigs——一种秒级启动、预装代码仓库与 coding agent 的云工作站。团队可通过网页、Slack、Linear、SSH、CLI、API,乃至 Codex、Cursor 等应用远程操控同一台工作站,多名成员能实时查看、共享 agent 会话,并支持 VM 快照快速还原环境。每个 Rig 可同时跑一个或多个任意 harness 的 agent,还能让 rig 之间互相通信、按需拉起新 rig,运行在 Amika 云或用户自有云/本机上。创始人称,产品源于他们自己并行跑大量长任务 agent 的痛点:环境隔离繁琐、关掉笔记本任务就中断、从 Sentry/Linear 触发任务很别扭。定价为前两周 2 台 VM 免费、之后 $30/月 + 算力费,并强调开源核心(github.com/gofixpoint/amika)。 来源:Get Ready For AgentsAmika 官网

07 CockroachDB 推 Continuum:用"数据库庄园"接住 agent 的爆发式读写

Cockroach Labs 9 月 16 日发布 Cockroach Continuum,把"数据库庄园"(estate)而非单个集群作为管理单元,专为 agent 时代的高并发、短命、不可预测负载设计。其三大支柱:数据库虚拟化(数千个隔离虚拟集群共享容量,毫秒级从零扩到整集群)、Cockroach Plenum(存算分离、按实际存储计费)、Cockroach Aegis(agent 运维层,7×24 观察全庄园并给出修复建议,人审批后执行)。公司援引 7 月生产遥测:90% 集群 CPU 利用率低于 20%、85% 集群存储用不到一半——传统按峰值预留造成巨大浪费。内部试点中,500 人两月内借助 agent 搭建 1000+ 应用、数据库从 13 个增至 392 个,组织总成本仅 $250。分析师提醒,池化也带来厂商锁定与跨负载干扰的新风险。 来源:Cockroach Labs 官方博客Cockroach Continuum 产品页

08 生数 Vidu S2 发布:视频不再"生成完就交付",而是边播边改

生数科技 9 月 15 日发布 Vidu S2,把实时视频从"能对话"推进到"能表演、能现场改写"。S2-Avatar 将实时输出提至 720P、25—42FPS,支持舞蹈等大幅动作,且生成途中可随时丢入新参考图(杯子、衣服、场景),由 VLM Agent 维护动作状态,让角色"接过道具继续演"。S2-Editing 则持续接收摄像头或源视频流,按文本指令实时改风格、换装、换人、换背景,靠"帧对齐稀疏注意力"锁死原视频同一时刻画面,运动轨迹不穿帮。论文(arXiv 2609.11638)显示 S2-Avatar 在 StreamAV-Bench 九项指标全第一。更前沿的是把单目视频转为左右眼同步的"实时空间视频",直送 VR 头显。S1 到 S2 仅隔 69 天,发布即全量开放体验与 API。 来源:腾讯新闻今日头条

09 7 名博士生暑假从零训出 7B 模型 ZGCM-1,训练日志全开源

北京中关村学院 7 名博士生用一个暑假,从随机参数训出 7B 稠密模型 ZGCM-1(7.39B,32 层、262K 上下文),并把各阶段权重、中间 checkpoint、训练代码、数据配方与完整日志全部开源。技术报告(arXiv 2609.13356)显示,其 14 项推理 benchmark 在 7B—8B 量级平均第一,MATH-500 达 97.13,部分数学与搜索任务可媲美 Qwen3-235B、GLM-5.1;256K 上下文下混合注意力较全注意力吞吐高 3.94 倍,16K 预训练达同 loss 效率约为基线 4.2 倍。更特别的是"AI4AI"范式:七人调度数百个 Agent 分工处理数据、实验、评测,并用 L1—L5 框架诚实自评——实验监控/部署达 L4,而模型架构与算法设计仍只有 L2,关键决策靠人。这比"逆袭故事"更值钱:它把大模型研发从黑箱变成可检查的流程。 来源:量子位ZGCM-1 GitHub

10 Keydris 开源无凭证 MCP 模板:agent 调用前先"验权"

Keydris Labs 9 月 16 日发布 credential-free MCP server 模板,解决多 agent 环境下的密钥泄露难题。传统 MCP 服务器需长期持有 API key、PAT 等凭证,一旦被 agent 滥用或遭攻破即成攻击面;该模板服务端不存任何密钥,而是在每次工具调用时,通过 Keydris kit reader 中间件 redeem 一个"单次使用、动作限定"的 KIT action token,实时兑换该次调用所需凭证。模板兼容 Claude、Cursor 等 MCP 兼容 agent,开发者 clone 后保留中间件、替换 demo 工具即可。同一团队此前在 HN 推出代理式"权威校验"工具,在动作边界给出 ALLOW / APPROVAL REQUIRED / REJECT 决策并记录可审计日志。在 agent 大规模调用外部工具的当下,把长期凭证替换为按需短时令牌,正成为 MCP 安全的主流方向。 来源:Get Ready For AgentsWeb Pulse(Show HN)

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。
最新资讯