AGI 快讯
多信源采集 · 分钟级捕捉全球 AI 信号
🔥 AGI 快讯 | 9 月 16 日 23 时
本期 20 条
新模型

Union Alpha 发布:一家 stealth 团队的新 LLM 进入榜单

① LM Market Cap 9/16 更新显示,名为 Union Alpha 的 LLM 于今日发布,提供方标注为 stealth。

② 具体能力参数尚未公开,但已进入主流模型追踪库(452 个模型、60 家提供商)。

③ 匿名/隐身团队密集进场,基础模型赛道的"黑马"仍在持续涌现。

产品 / 语音

Amazon 宣布 Alexa 新 AI 模型

① Amazon 在 9/16 宣布新一代 Alexa 所基于的 AI 模型。

② 重点把对话与设备控制能力进一步统一到 Alexa 体系。

③ 智能音箱赛道从"指令式"转向"对话式 Agent",端侧语音助手重新升温。

新模型 / 研究

Jev 模型:只"判断选项"不写文本(TypeSafe AI)

① The Decoder 报道,前 OpenAI 研究员创立的 TypeSafe AI 发布 Jev,用于程序化逻辑判断而非生成文本。

② 模型输出的是选项/分类,而非自由文本,定位"可验证的决策"。

③ "判断型模型"成为生成式之外的新路线,可解释性与可控性受关注。

产品 / 隐私

Mozilla Smart Window 助手基于 Mistral 本地运行

① Mozilla 新 Smart Window 助手运行在 Mistral 模型上,强调本地执行。

② 把浏览器侧 AI 助手的能力与隐私保护结合。

③ 本地化浏览器 AI 成为对抗云端巨头的差异化路线。

安全 / 治理

"Claude 是否过于拟人而难以控制"引讨论

① The Information 发文讨论 Anthropic 是否让 Claude 过于拟人,导致更难被控制。

② 焦点是拟人化带来的用户依赖与对齐风险。

③ 模型"人格化程度"与可控性之间的张力,成为产品安全新议题。

研究 / 具身

arXiv:自适物理 AI——LLM Agent 能否管理长程物理任务

① 9/16 论文《Toward Self-Adaptive Physical AI》探讨 LLM Agent 管理长时程物理任务。

② 研究如何让智能体在真实物理环境中自适应调整策略。

③ 具身智能从"单步执行"走向"长程自治",是机器人落地的关键能力。

研究 / 训练

arXiv:Concertina 用数据驱动的自适应流水线并行训练长上下文

① 论文《Concertina》提出数据为中心的自适应流水线并行,提升异构长上下文 LLM 训练效率。

② 在混合并行下动态调度,降低长序列训练成本。

③ 长上下文训练的效率瓶颈被持续攻关,成本下降将传导到推理侧。

安全 / 研究

arXiv:测量并 exploited LLM 安全代码审查中的上下文偏差

① 论文揭示 LLM 辅助安全代码审查中存在"上下文偏差"并被利用。

② 给出测量方法与安全审查的加固思路。

③ AI 代码审查并非银弹,需警惕模型被上下文误导而漏判漏洞。

政策 / 监管

EU AI Act 进入 2026 主动执法阶段

① 截至 9/15,欧盟 AI 法案进入 2026 主动执法期,Article 50 透明度义务生效。

② 通用 AI(GPAI)提供者与高风险系统的合规义务逐步落地。

③ 全球首部综合 AI 法从"纸面"进入"执法",出海企业合规成本上升。

安全 / 治理

Anthropic 发布 9 月威胁情报报告

① Anthropic 发布 9 月"Countering misuse"报告,梳理 2025/12–2026/8 被瓦解的滥用案例。

② 覆盖七大类危害,包括网络、生物与欺诈等。

③ 头部实验室把"威胁情报"常态化,安全披露成为行业基础设施。

具身 / 机器人

Tesla Optimus Gen-3 进入量产初期

① 9 月供应链显示特斯拉 Optimus Gen-3 进入量产初期,目标约 1000 台/周(月底)、年底冲 2500 台/周。

② 弗里蒙特旧 Model S/X 产线已改造为机器人专属产线,约 1200 台已内部部署测试。

③ 人形机器人从原型跨入产线,"物理 AI"量产拐点临近。

安全事件

AI agents 利用 PaperCut 漏洞攻破 395+ 组织

① Help Net Security 报道,AI agents 利用 PaperCut NG/MF 漏洞发起全球攻击,48 国 440 台服务器被攻破,部分在 30 秒内失守。

② 攻击链由 Agent 自动化完成侦察与利用。

③ 当防御方还在手动响应,攻击方已用 Agent 规模化,"AI 对 AI"的安全军备竞赛白热化。

医疗 AI

Nature 综述:AI 药物发现的临床证据仍待验证

① Nature Reviews Drug Discovery 持续关注 AI 药物发现,讨论从靶点发现到临床的"证据缺口"。

② 以 Insilico 的 rentosertib 等为代表,首批 AI 设计分子进入临床但样本有限。

③ "首个 AI 发现药物"的归属之争,本质是临床证据强度的较量。

办公 AI

Microsoft 365 Copilot 持续发布更新,企业办公 Agent 化

① Microsoft Learn 的 M365 Copilot 发布说明自 9/3 起持续更新功能。

② 重点从"写作助手"转向可执行的"办公 Agent"(会议、邮件、文档联动)。

③ 办公套件正被重构成 Agent 工作台,企业知识流被重新编排。

产品 / MCP

Microsoft 官方 Notion 联邦 Copilot 连接器基于 MCP

① Microsoft 提供基于 MCP 的 Notion 联邦连接器,让 Copilot 拉取 Notion 页面参与回答。

② 打通企业分散的知识库与统一助手。

③ MCP 正成为办公 AI 互联的事实协议,知识孤岛被逐步打通。

AI 搜索

Perplexity 月活破 1 亿,搜索格局被重塑

① 近期统计显示 Perplexity 月活突破 1 亿,ChatGPT Search 与 Gemini 持续挤压传统搜索。

② AI 搜索从"给链接"转向"给答案",引用与归因规则成焦点。

③ 搜索入口迁移,SEO 向 AEO(答案引擎优化)演化。

AI 搜索

GEO(生成引擎优化)成品牌可见性新战场

① 研究显示品牌在 ChatGPT / Perplexity / Gemini / Claude 中的"被引用率"成为新 KPI。

② 传统 SEO 权重下降,结构化、可被引用的内容更受生成引擎青睐。

③ 营销从"排谷歌"转向"被 AI 引用",内容策略被迫重写。

开源

开源 LLM 格局:Qwen 3.7 编码领先,GLM-5.1 / DeepSeek V4 Pro / Llama 3.3 居前

① 2026 开源 LLM 能力榜显示 Qwen 3.7、GLM-5.1、DeepSeek V4 Pro、Llama 3.3 70B 居前列。

② Qwen 3.7 在编码任务上表现突出,DeepSeek V4 Pro 综合强。

③ 开源与闭源差距继续收窄,"自托管"成为企业降本与合规的现实选项。

办公 AI

企业 AI 办公四强横评:M365 Copilot / Gemini for Workspace / Notion AI / Slack AI

① 近期横评对比四大企业办公 AI 助手的能力、集成与工作流。

② 各家在"知识检索、自动化、协作"上各有侧重。

③ 企业选型从"单点工具"转向"平台级 Agent 生态"。

AI 搜索

AI 搜索统计 2026:AI Overviews 与品牌可见性量化

① 16 小时前发布的统计汇总 AI Overviews、ChatGPT 搜索与品牌在各引擎的可见性数据。

② 给出 35+ 数据点刻画生成式搜索的采用与引用模式。

③ 量化指标让"AI 搜索可见性"从玄学变成可衡量、可优化的渠道。