infoAI 日报 2026-09-152026年09月15日169122论文 75 / 官方 5 / 英文媒体 41 / 中文媒体 48本页聚合 AI 前沿信息:arXiv 论文、OpenAI/DeepMind/Meta/HuggingFace 官方博客、国内外 AI 媒体,均为最近 7 天内发布,附中文摘要与重要度评级。DevFest is backGoogle AI Blog2026-09-14T16:00:00Zhttps://blog.google/innovation-and-ai/technology/developers-tools/devfest2026/谷歌宣布 DevFest 2026 回归,这是面向全球 Google Developer Groups 的年度开发者社区活动。官方博客以动画形式发布预告,号召开发者参与。该活动主要面向开发者生态,与 AI 前沿研究关联较弱。AI agents blew the whistle on their cheating colleaguesMIT Tech Review AI2026-09-14T16:00:00Zhttps://www.technologyreview.com/2026/09/14/1144037/ai-agents-blew-whistle-o-cheating-colleagues/谷歌 DeepMind 实验首次观察到 AI Agent 的「举报」行为:一组 Agent 解数学题时分裂为对立派系,部分作弊后,其他 Agent 试图阻止。该现象对研究如何让成群的自主 AI Agent 保持对齐具有启示意义。Microsoft’s new AI ‘code of conduct’ tells models not to hack systems or trick humansTechCrunch AI2026-09-14T16:27:53Zhttps://techcrunch.com/2026/09/14/microsofts-new-ai-code-of-conduct-tells-models-not-to-hack-systems-or-trick-humans/微软发布新的 AI「行为准则」,要求其模型不得入侵系统或欺骗人类。准则既包含支持人类而非取代人类、促进人类繁荣等总体原则,也列出了落实这些原则的具体安全约束。这反映出头部厂商正主动为 AI 行为设定规范。New York Seizes a Dozen Celebrity Deepfake WebsitesWired AI2026-09-14T16:50:00Zhttps://www.wired.com/story/new-york-seizes-a-dozen-celebrity-deepfake-websites/曼哈顿地区检察官办公室查封了 12 个名人深度伪造网站,这是针对有害 deepfake 网站史上最大规模的法律行动,共涉及约 1200 名受害者。此举标志着监管与执法层面对 AI 换脸滥用的打击力度显著升级。With iOS 27, I’m actually using Siri againTechCrunch AI2026-09-14T17:10:30Zhttps://techcrunch.com/2026/09/14/with-ios-27-im-actually-using-siri-again/苹果在iOS 27中终于推出拖延已久的Siri重大改版,让这款语音助手在日常使用中变得真正实用。TechCrunch记者表示自己因此重新开始使用Siri,显示苹果在AI助手体验上的追赶取得实质进展。Fashion app Daydream uses Apple Intelligence to help you shop the outfits in your camera rollTechCrunch AI2026-09-14T17:00:00Zhttps://techcrunch.com/2026/09/14/fashion-discovery-app-daydream-uses-apple-intelligence-to-help-you-shop-the-outfits-saved-in-your-camera-roll/时尚应用Daydream借助iOS 27带来的Apple Intelligence,新增将相册中保存的穿搭照片转化为可购买商品的功能,并支持通过Siri直接搜索商品而无需打开应用。这体现了苹果智能生态向第三方应用的落地扩展。OpenAI has hundreds of contract workers reading your ChatGPT conversationsThe Decoder2026-09-14T17:15:28Zhttps://the-decoder.com/openai-has-hundreds-of-contract-workers-reading-your-chatgpt-conversations/据404 Media报道,OpenAI雇佣数百名合同工阅读真实ChatGPT对话并按1-7分打分,部分目的是减少模型谄媚和拟人化行为。提示词虽经匿名化处理,但仍可能包含敏感数据,且用户需主动关闭默认开启的“为所有人改进模型”设置才能避免人工审查。The AI industry has taken a doomer turn. What now?MIT Tech Review AI2026-09-14T17:54:22Zhttps://www.technologyreview.com/2026/09/14/1144048/the-ai-industry-has-taken-a-doomer-turn-what-now/MIT Tech Review报道AI行业出现"末日论"转向,Anthropic CEO Dario Amodei发表文章呼吁放缓大语言模型开发速度。Amodei在文中阐述了他所看到的技术潜在危险,反映出AI安全担忧正从边缘讨论进入主流行业话语。Jensen Huang puts Trump on speakerphone onstage to announce robots won’t take over the worldThe Verge AI2026-09-14T20:03:37Zhttps://www.theverge.com/tech/995079/president-donald-trump-calls-nvidia-ceo-jensen-huang-all-in-summit英伟达CEO黄仁勋在All-In峰会上台演讲时,将特朗普总统的电话接入现场扬声器,引发全场关注。通话中特朗普谈及机器人不会接管世界等话题,这是黄仁勋再次在工作场合接听总统来电,凸显AI与政商互动的热度。Watch astronaut Christina Koch and Google’s James Manyika discuss space, technology, and discovery.Google AI Blog2026-09-14T19:00:00Zhttps://blog.google/innovation-and-ai/technology/ai/dialogues-christina-koch/Google发布视频,宇航员Christina Koch与Google研究高级副总裁James Manyika对谈太空、技术与探索。双方围绕科学发现与前沿技术展开交流,体现Google在AI与科研交叉领域的品牌传播布局。OpenAI buys smartphone camera maker Glass Imaging for $300 million, report saysTechCrunch AI2026-09-14T20:44:14Zhttps://techcrunch.com/2026/09/14/openai-buys-smartphone-camera-maker-glass-imaging-for-300-million-report-says/据报道,OpenAI以3亿美元收购智能手机摄像头公司Glass Imaging,后者由两位前苹果工程师创立,曾主导开发苹果人像模式。此举或强化OpenAI在移动端影像与多模态硬件方向的布局。Sakana AI Researchers Introduce PC-ALM, a Layer-Local Alternative to Backpropagation That Trains 1000-Layer NetworksMarkTechPost2026-09-14T20:46:16Zhttps://www.marktechpost.com/2026/09/14/sakana-ai-researchers-introduce-pc-alm-a-layer-local-alternative-to-backpropagation-that-trains-1000-layer-networks/Sakana AI研究者提出PC-ALM,用逐层拉格朗日乘子替代反向传播,实现层局部学习。该方法在线性网络中可精确还原BP梯度,将梯度余弦相似度从0.604提升至0.909,并能训练1000层残差MLP,MNIST精度仅落后BP约2个点,代码已MIT开源。What execs and politicians are saying about slowing down AI developmentThe Verge AI2026-09-14T21:21:42Zhttps://www.theverge.com/ai-artificial-intelligence/995141/ai-executives-politicians-safety-regulation-anthropic-dario-amodeiAnthropic CEO Dario Amodei 发表长文《We Must Pace the Frontier》,主张应放缓 AI 发展节奏,引发业界与政界密集表态。多位 AI 领袖和政客随后公开支持或反对其观点,媒体汇总了各方立场,凸显 AI 安全与加速发展之争持续升温。Reward AI Releases OM-1: A Robot Policy Trained on Human Demonstrations Only, With No Teleoperation or On-Robot DataMarkTechPost2026-09-14T21:08:17Zhttps://www.marktechpost.com/2026/09/14/reward-ai-releases-om-1-a-robot-policy-trained-on-human-demonstrations-only-with-no-teleoperation-or-on-robot-data/Reward AI 发布通用操作策略 OM-1,仅用 7 自由度可穿戴手套采集的人类演示数据训练,无需遥操作或机器人本体数据。该策略可在工业机械臂和人形机器人上以人类速度运行,不到 30 分钟数据即可学会新任务,但目前未公开权重、代码或 API。Nvidia CEO Jensen Huang tells Trump ‘we’re not going to let [an AI slowdown] happen’TechCrunch AI2026-09-14T21:51:02Zhttps://techcrunch.com/2026/09/14/nvidia-ceo-jensen-huang-tells-trump-were-not-going-to-let-an-ai-slowdown-happen/英伟达 CEO 黄仁勋向特朗普表态称不会让 AI 发展放缓,与马斯克、奥特曼支持 Dario Amodei 放缓 AI 开发节奏的立场形成鲜明对比。这反映出 AI 行业内部在监管与加速问题上的分歧,也凸显英伟达作为算力供应商在 AI 加速中的核心利益。Agent Harness vs Agent Framework vs MCP: Which Layer Owns the Loop, State, Tools, Permissions, and RecoveryMarkTechPost2026-09-14T21:54:22Zhttps://www.marktechpost.com/2026/09/14/agent-harness-vs-agent-framework-vs-mcp-which-layer-owns-the-loop-state-tools-permissions-and-recovery/文章梳理现代 Agent 技术栈的三层结构:Agent Harness、Agent Framework 与 MCP,并分析各层在循环控制、状态管理、工具调用、权限与故障恢复上的职责归属。作者基于可验证来源给出重叠分析,帮助开发者厘清各层边界,避免架构设计中的职责混淆。Is Big Tech’s AI slowdown a safety pact or a cartel?The Verge AI2026-09-14T22:59:41Zhttps://www.theverge.com/ai-artificial-intelligence/995186/is-big-techs-ai-slowdown-a-safety-pact-or-a-cartelThe Verge 报道,OpenAI、Anthropic、Google DeepMind 与马斯克等 AI 巨头周末松口同意放缓 AI 开发,宣称目标是「为前沿定速」。但批评者质疑此举实为借安全之名行卡特尔之实,意在抬高行业门槛、遏制竞争。早报|iOS27正式推送/比亚迪高管:燃油车在中国没有未来/iPhone 18 Pro渠道降价900元,苹果称不干预爱范儿2026-09-15T00:08:20Zhttps://www.ifanr.com/1680097?utm_source=rss&utm_medium=rss&utm_campaign=爱范儿早报汇总多条科技动态:iOS 27 正式推送,广汽一汽签署重组意向协议,中国地震台网中心正与苹果沟通 iOS 地震预警功能,马斯克旗下公司撤回对苹果的反垄断诉讼但继续起诉 OpenAI。iOS 27、MacOS 27 正式发布;豆包手机助手消费者版亮相;李想:「大车」趋势一定会结束极客公园2026-09-15T00:17:23Zhttp://www.geekpark.net/news/370306特朗普公开抨击 Anthropic CEO Amodei 呼吁放缓前沿模型开发的立场,称 AI 唯一需要的护栏就是一位高智商总统,表态较此前明显强硬。白宫内部就 AI 监管形成两派,副总统万斯则警告企业主动求监管形似特洛伊木马。Jensen Huang took a call from Trump, and showed off something else, tooTechCrunch AI2026-09-15T01:50:48Zhttps://techcrunch.com/2026/09/14/jensen-huang-took-a-call-from-trump-and-showed-off-something-else-too/英伟达CEO黄仁勋在公开场合接听了特朗普的实时来电,引发关注。不过部分观察者更关注他用来接电话的设备本身,暗示可能是英伟达相关产品或特殊终端,具体细节尚未披露。:fire: xbatis 1.10.9 正式发版,mybatis 系列最好用最简单最方便的 ORM !!!开源中国2026-09-15T01:57:31Zhttps://www.oschina.net/news/502481xbatis 1.10.9 正式发布,定位为 mybatis 系列中最好用、最简单的 ORM 框架。官方称可减少三分之一甚至三分之二的持久层代码,支持单表与连表查询,并新增 xbatis-ddl-auto 的 SYNC 模式。coost v4.0.0 发布开源中国2026-09-15T01:46:39Zhttps://www.oschina.net/news/502479coost v4.0.0 发布,这是一次较大版本更新,编译器要求提升至 C++17。新版本移除若干高维护成本模块,新增 Windows ARM64 与 FreeBSD 平台支持,并优化核心组件性能与 API,升级前需注意破坏性变更。生态新成果!麒麟100“灵触&灵萃”带来交互新体验开源中国2026-09-15T02:35:12Zhttps://www.oschina.net/news/502484麒麟100推出AI交互功能“灵触&灵萃”,将AI能力直接集成到鼠标操作中,试图打破鼠标诞生40余年来的人机交互固有逻辑。该功能由openKylin技术衍生发行版推出,探索AI驱动的新型交互体验。7名博士生仅用3个月从零训练7B大模型:代码+数据+训练日志全公开量子位2026-09-15T02:17:34Zhttps://www.qbitai.com/2026/09/489227.html7名博士生仅用3个月从零训练出7B大模型,并公开代码、数据与训练日志。研发过程中有几百个Agent参与,体现AI辅助AI研发的新范式,对开源大模型和Agent协作研究有参考价值。ZGCM-1: A Fully Open and Extremely Efficient Foundation Model for Math and Agentic SearcharXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13356ZGCM-1 是一个完全开源的 7B 稠密基础模型,从零训练,强调数据、系统与算法效率,支持 256K 上下文。其核心理念是紧凑模型无法被动记忆开放网络,需结合内部思考与外部工具调用,采用门控滑窗与全注意力交错的架构系统协同设计。Converge Then Diversify: Decoupling Convergence and Diversity in Multi-Objective Bayesian OptimisationarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13396该论文提出将多目标贝叶斯优化中的收敛性与多样性解耦的新方法,先收敛再多样化。现有 MOBO 方法通常同时追求逼近帕累托前沿与保持解集分布,本文通过分离这两个目标提升样本效率与解集质量。Generalized Agent Iteration: One Formal Framework for Iterative Policy Improvement and Recursive Self-ImprovementarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13406论文提出「广义智能体迭代」(GAI)框架,试图为迭代策略改进与递归自我改进(RSI)提供统一的形式化描述。作者指出 RSI 在多个尺度上被宣称,但缺乏统一框架,而经典领域的广义策略迭代(GPI)理论性质明确,可作为对照基础。Vibe Patenting: Evaluating LLM Judges for Professional Patent-Drafting AgentsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13422研究通过「Vibe Patenting」端到端专利撰写测试台评估 LLM 裁判在专业工作中的可靠性。实验显示,裁判引导的迭代修订能持续提升裁判评估的质量,而无引导修订趋于饱和,提示 LLM 裁判在复杂专业任务中的评估存在自我强化偏差。Toward Self-Adaptive Physical AI: Can LLM Agents Manage Long-Horizon Physical Tasks?arXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13436论文探索构建自适应物理 AI 智能体的可行性,使其能管理长期物理任务。现有方法要么需要大量数据与重训练,要么仅聚焦虚拟世界,而物理任务要求智能体持续观察环境、执行关键动作并在环境变化中保持有效。LabAgent: Customize Any Research Hubs for Scientific Discoveries Using AI AgentsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13437LabAgent 是一个面向实验室持续科研工作的复现与发现框架,旨在解决人员流动导致方法失传的问题。它利用 AI 智能体定制研究枢纽,帮助新研究者继承并扩展前人的方法,推动科学发现的连续性。TimeThink: Eliciting Compositional Reasoning in Timeseries Large Language ModelsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13457TimeThink 旨在激发时间序列大语言模型的组合推理能力。现有 TS-MLLM 常无法捕捉动态时间模式,仅提供缺乏解释的隐式推理,在医疗等高风险场景中不足;基于强化学习的方法又受限于狭窄的分布内数据。Root-Cause Attribution Is a Search Problem: Continual Search for Long-Horizon Agent FailuresarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13463论文将长时程智能体失败的根因归因(RCA)建模为搜索问题,提出持续搜索方法。随着执行日志规模增大,LLM 自动 RCA 诊断准确率下降,因相关信息稀疏且分散,该方法旨在将结果级信号转化为可操作的干预措施。Governing at Machine Speed: An Adaptive Intelligence Architecture for Real-Time AI Policy EnforcementarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13466论文指出企业 AI 采用率已达 78%,但治理基础设施滞后,提出「认证缺口」概念:组织虽有治理政策,却无法在监管时限内提供可审计、防篡改的执行证据。文章基于斯坦福 2026 AI 指数报告与 IBM/Ponemon 数据,提出实时 AI 政策执行的适应性智能架构。OrchSLM: Probing the Dynamics of Small Language Model OrchestrationarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13470OrchSLM 研究小语言模型(SLM)编排的动态特性。LLM 依赖云基础设施在延迟、隐私、连接与成本上存在挑战,而 SLM 适合智能体工作流中的重复性窄任务,但其容量与上下文窗口有限,论文探索如何编排多个 SLM 以弥补不足。Grounded Adjudication of Variations across Extracted TimeLines (GAVEL): Comparing Clinical Timelines Against Their Case ReportsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13475GAVEL 是一种 LLM 裁判协议,用于比较临床时间线与病例报告,返回差异类型、判定与报告段落。研究评估了事件匹配器,审查了 GPT5.6sol 与 DeepSeek V3.2 的 2738 项发现,对六个 LLM 抽取器和两名人工标注者排名,并测试了 GAVEL 引导的合并。Token Efficient Task Execution via Application Behavior Modeling for Web AgentsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13491论文提出 OdoBot,一种通过应用行为建模实现 token 高效任务执行的网页智能体架构。传统网页智能体通过分析 UI 并交互来执行自然语言任务,token 成本快速上升,OdoBot 以更低成本完成任务,显著降低智能体基础设施开销。Fraglingo: Molecular Design via Attachment-Aware Autoregressive Fragment GenerationarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13519Fraglingo 提出一种基于片段的分子设计方法,通过连接感知的自回归片段生成实现。现有方法常将片段选择与连接预测分离,限制了生成空间;Fraglingo 模拟化学家实际编辑操作,如扩展骨架、替换取代基或在指定连接位点修饰骨架。From Legal Text to AI-specific Risk Sources: A Systematic Analysis of the EU AI Act's High-Risk RequirementsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13535论文系统分析欧盟《人工智能法案》高风险要求与 AI 特定风险源之间的映射关系。AI 风险管理依赖结构化风险分类法,而法案的高风险要求隐含处理了哪些风险源尚不明确,本文旨在建立两者之间的清晰对应。Asclepius: An Adaptive Harness for Long-Horizon Clinical AgentsarXiv AI (cs.AI)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13543Asclepius 是面向长时程临床智能体的自适应框架。现有 LLM 智能体多在短时单任务轨迹上评测,而真实部署需在资源竞争下运行数小时。研究使用临床环境模拟器(CES),智能体需在急诊科连续值班中应对时间与资源压力,当前智能体虽多能得出正确诊断,却无法完成完整交付。Token Merging for Multilingual Speech Recognition: A Systematic Study Across Model Scale and Fine-TuningarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13151论文系统评估 token 合并技术在多语言语音识别中的应用,覆盖 Whisper 模型家族、16 种语言与三种模型规模。Token 合并通过动态组合冗余特征缩短推理序列长度,无需重训练即可降低计算成本,研究还测试了其与微调的交互影响。PhysMent: An Interactive Approach For LLM Reasoning In Physics ProblemsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13152PhysMent 是一个评估 LLM 物理推理能力的基准,要求模型通过迭代、工具中介的方式与 MuJoCo 物理模拟器交互。与静态基准不同,PhysMent 要求模型通过施力、查询物体状态、推进时间与修改场景几何来主动发现信息后再作答。Lexical Prompt Compression for Large Language Models: A Training-Free, Deterministic Pipeline with Empirical Pareto Analysis Across Eleven Task CategoriesarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13154论文提出一种免训练、确定性的词汇级提示压缩流水线,并在 11 类任务上做经验帕累托分析。LLMLingua 等学习式压缩方法虽压缩率高,但需辅助语言模型且非确定性;本文探索互补问题,即在不依赖辅助模型的前提下实现确定性压缩。TestHallVQA: Exploring LVLMs' Document-Level Reasoning under Redundant Contexts from Scientific ExamsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13158TestHallVQA 是一个探索大型视觉语言模型在冗余上下文下文档级推理能力的基准,取材于科学考试。现有平面 VQA 基准多强调孤立挑战,或偏重长文档理解而推理深度不足,或限于单页无噪声场景;本文通过理论分析识别了无关视觉 token 导致的性能下降。Clinical Reasoning Under a Partially Observed Objective in Cone Beam CT Report GenerationarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13238论文研究锥形束 CT 报告生成中的部分可观测目标下的临床推理。评分采用复合目标,80% 权重给 LLM 对事实蕴含的判定,20% 给词汇重叠,但开发阶段仅可见词汇部分;作者用纯 Python 复现了 BLEU-4 与 METEOR,并构建离线蕴含代理,AUC 达 0.987。RFCLLM: Evaluating LLMs' Reasoning Ability of Network Protocol State MachinesarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13389RFCLLM 评估 LLM 对网络协议状态机的推理能力。将文本规范映射为形式化表示对协议设计与实现正确性至关重要,但 LLM 生成的映射被假设能完美理解规范,实际未必成立;本文考察 LLM 对有限状态转移系统隐式表示的理解程度。CVSS-X: A Multilingual Speech-to-Speech Translation Corpus for 28 LanguagesarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13413CVSS-X 是一个大规模合成语音到语音翻译语料库,覆盖 28 种目标语言、12 个语系。它扩展了 CVSS 并反转翻译方向,从英语译向 28 种语言,每语言约 24 万对平行语音,总计超 1.6 万小时,是 CVSS 的八倍,提供规范语音与跨语言声音克隆两个变体。Causal Analysis and Mitigation of Spurious Onsets in Full-Duplex Speech LLMsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13445论文对全双工语音 LLM 中的虚假起始语音进行因果分析与缓解。Moshi 及其衍生 PersonaPlex 可边听边说,但在用户长时间静默时会在数字零输入下不当开始说话,Moshi 与 PersonaPlex 分别在 40 次五分钟续写中出现 12 次和 11 次;研究检验了重复采样与条件依赖两种假设。Hindsight Bias in Clinical Temporal Reasoning: How Future Data Exposure Affects Large Language Model JudgmentarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13454论文研究临床时间推理中的后见之明偏差,即未来数据暴露如何影响 LLM 判断。临床决策是前瞻性的,但模型常在揭示最终诊断与结果的回顾性记录上评估,可能奖励使用未来信息而非在决策点的不确定性下推理;作者构建了包含 171 份病例报告的配对基准。A Hybrid Hierarchical 1D-CNN-BiLSTM Framework for Extractive Summarization of Biomedical and Clinical TextarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13481用分层1D-CNN-BiLSTM做生物医学抽取式摘要,避免生成式幻觉。From Token Probabilities to Semantic Constraints: Towards Declarative Probabilistic Evaluation of Language ModelsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13520提出ModelLog声明式概率框架,用符号约束评估语言模型预训练行为。Harmfulness Propagation Dynamics: Layer-wise Trajectories of Adversarial Intent in Large Language ModelsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13534发现有害提示的隐藏态沿层单调上升的传播动力学特征,可跨层识别有害意图。Domain-Specific Jargon in Large Language Models: A Comparative Analysis between General-Purpose and Specialist ModelsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13556构建医学术语评测基准,发现通用模型在术语理解上反超医学微调模型。Toward Complete Hospital Discharge Summarization with Abstract Meaning RepresentationarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13581用抽象语义表示图做证据驱动对齐,实现可溯源的低幻觉出院摘要生成。Same Patient, Different Order: Action-Level Reliability of Clinical LLM Agents Under Repeated RunsarXiv CL (cs.CL)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13582提出同输入重跑评测,揭示临床LLM智能体动作级不可靠性。BudgetBench: A Budget-Tiered Protocol and Pilot Harness for Memory Strategy Evaluation in Local Large Language Model AgentsarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13149提出以输入token预算为自变量的记忆策略评测协议与工具,用于本地LLM智能体。A derivative-fidelity failure mode in physics-informed neural networks: strengthened benchmark evidence from function-value trainingarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13171揭示PINN导数保真度失效模式:函数值拟合好不代表导数准确。Land Art as a Big-Data Climate SensorarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13182用多特征复杂度签名分析大地艺术Spiral Jetty影像,作为气候大数据传感器。LLMs or Naive Bayes? Old Gems or New WaysarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13185对比朴素贝叶斯与LLM文本分类,发现LLM仅在零数据场景占优且易受污染。Early Prediction of Satellite Collision Probability Using a Hybrid TCN-Transformer Model for a CDM-Based Conjunction Analysis FrameworkarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13191用TCN-Transformer混合模型基于CDM数据提前预测卫星碰撞概率。Evaluating LLM-Generated Rules for Heart Disease PredictionarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13192比较传统机器学习与LLM生成规则系统在心脏病预测上的表现。Diagnosing Faults in Reinforcement Learning Simulators and World Models with Canonical Polynomial InvariantsarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13194用规范多项式不变量诊断RL模拟器与世界模型故障,质疑物理结构先验的收益。Machine Unlearning for Speech Question Answering in Large Audio-Language ModelsarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13195研究大型音频语言模型语音问答中的机器遗忘,应对隐私记忆风险。Algorithmic Information Dynamics of Learning: A Certified, Differentiable Complexity Controller for GrokkingarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13197用可微算法复杂度估计器构建控制器,加速grokking现象出现。SPICE: Simple Polysemantic Feature Interpretation via Clustering-based ExplanationarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13198提出SPICE,用聚类解释实现通用、无需预设K的多义神经元特征解释。Discovering and Preserving Category Correlation Knowledge via Adaptive Reciprocal Knowledge DistillationarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13199提出自适应互惠知识蒸馏,动态双向传递知识并聚焦难样本。Criticality in Dissimilar Decomposition and Undersampling of Random Datasets with AnomaliesarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13201研究含AI生成异常数据的随机数据集分解与欠采样临界性质。Do Tabular Foundation Models Still Need Feature Engineering?arXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13202系统研究表格基础模型是否仍需人工特征工程,发现特征工程收益有限。Scalable partial information decomposition for symptom networks via supervised embeddingsarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13203提出基于监督嵌入的可扩展部分信息分解,用于症状网络分析。GradRepair-ODE: Certified Gradient Repair for Neural ODE TrainingarXiv LG (cs.LG)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13204提出GradRepair-ODE,为神经ODE训练提供可认证的梯度修复。Personalized and Explainable Blood Pressure Estimation from PPG via Hybrid CNN--Morphological FeaturesarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13190提出融合CNN与形态学特征的可解释个性化PPG血压估计框架。Part Grounding, Not Action Knowledge: Locating the Bottleneck in VLM Affordance PredictionarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13225定位VLM可供性预测瓶颈为部件定位而非动作知识。Synthetic Leprosy Image Generation Using Mask-Conditioned Latent Diffusion and Transfer Learning from Large Chronic Wound DatasetsarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13226用掩码条件潜扩散与慢性伤口数据迁移学习生成合成麻风病图像。Don't Just Look, Intervene: Perturbation Based Region Labeling for VQA ImagesarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13228提出基于扰动反事实搜索的区域标注方法,为VQA图像提供模型因果视觉证据。What Does the Encoder Actually Decide? A Controlled Comparison of Vision Backbones on Joint Tree Segmentation and Stereo DeptharXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13232控制变量比较视觉编码器对树木分割与立体深度的联合影响EMCStereo: Attention-Enhanced Stereo Matching for Thin-Structure Depth Estimation with a Synthetic Tree-Branch BenchmarkarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13233提出EMCStereo注意力立体匹配方法及树枝细结构合成基准Occlusal Geometry in Closed Form for Orthodontic Report GenerationarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13237利用咬合几何闭式解生成正畸报告,替代多模态描述范式Abstract-LoRA: Unlocking Single-Image Style Transfer through Targeted U-Net Block TrainingarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13239Abstract-LoRA通过定向U-Net块训练实现单图风格迁移ArtSociety: Multi-Agent Multimodal Collaboration for Art Emotion UnderstandingarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13240ArtSociety多智能体多模态协作框架用于艺术情感理解SJD-SV: Speculative Jacobi Decoding with Semantics Verification for Autoregressive Image GenerationarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13245SJD-SV用语义验证改进推测Jacobi解码加速自回归图像生成Pixel-wise Planarity for High-Precision Monocular Plane SegmentationarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13246提出逐像素平面性预测实现高精度单目平面分割Evaluation of MLLM-Agnostic Plug-and-Play Keyframe Selection Methods for Long Video UnderstandingarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13250评测MLLM无关的即插即用关键帧选择方法用于长视频理解Preserving Subject-Clarity in Image Outpainting with Multiscale Wavelet SupervisionarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13251用多尺度小波监督在图像外扩中保持主体清晰度(How) Do MLLMs Report Bistable Images Like Humans?arXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13254研究MLLM对双稳态图像的报告行为及其内部计算机制A Comprehensive Review of Multimodal Facial State Analysis: Tasks, Methods, and ResourcesarXiv CV (cs.CV)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13255综述多模态面部状态分析的任务、方法与资源Stochastic Gradient Descent over P2arXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13343研究概率测度空间P2上随机梯度下降的扩散近似理论Beyond Point Forecasts: A Survey on Probabilistic Forecasting for Time Series and Spatiotemporal DataarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13345综述时间序列与时空数据的概率预测方法统一视角A pullback-corrected scalar auxiliary variable optimizer with momentum and adaptive mobilityarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13569提出带动量与自适应移动性的拉回校正标量辅助变量优化器Resolution-Independent Analysis of Encoder--Decoder Operator Learning via Limiting KernelsarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.13798用极限核分析编码器-解码器算子学习的分辨率无关性Just add noise: Debiasing tree-based variable importance in mixed dataarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14083通过加噪纠正树模型变量重要性对分类变量的偏差Exact Finite Attention Responses From RoPE DerivativesarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14127基于RoPE导数推导注意力干预的精确有限响应Multi-source conformal prediction: leveraging heterogeneity via localizationarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14531提出多源随机局部化共形预测利用异质性提升覆盖Evaluation of optimisation and Bayesian inference methods for reaction rates in atmospheric chemical mechanismsarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14569评测大气化学机理反应速率的优化与贝叶斯推断方法PU classification under Non-SCAR: clustering-assisted logistic model with oversampling enhancementarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14675非SCAR假设下结合聚类逻辑回归与SMOTE的PU分类方法From matrix inversion to constraints: provably tighter confidence regions for importance weights in label shiftarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14802用矩阵约束框架为标签偏移重要性权重构造更紧置信域A Functional SVD Framework for Regularized Multivariate Functional PCA with Dual PenalizationarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14815提出双惩罚正则化多元函数PCA的函数SVD框架Shapley Value Estimation for Multi-Site Data with Blockwise-Missing FeaturesarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14902针对多站点块缺失特征的Shapley值估计方法Steady-State Convergence of Stochastic ApproximationarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.14922建立马尔可夫乘性噪声下随机逼近的稳态收敛统一理论Data Attribution at Scale via Influence Matrix EstimationarXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.15044通过影响矩阵估计实现大规模数据归因Conformal Individual Treatment Effect Estimation under Networked InterferencearXiv ML (stat.ML)2026-09-15T04:00:00Zhttps://arxiv.org/abs/2609.15254提出网络干扰下的共形个体处理效应估计方法,放宽无干扰假设,实现有效覆盖。Ubuntu 26.10 “Rust 化”更进一步:coreutils 全部迁移到内存安全实现开源中国2026-09-15T03:44:05Zhttps://www.oschina.net/news/502490/ubuntu-26-10-rust-coreutils-completeUbuntu 26.10「Stonking Stingray」将成为首个 coreutils 全面 Rust 化的发行版,ls、cat、chmod、du 等常用命令底层全部换成 uutils 实现。Canonical 自 2025 年起推进发行版「锈化」,25.10 是首个试点版本,此举旨在提升内存安全、减少 C 语言内存漏洞风险。Meta Introduces ZGateway: A Stateless Proxy Tier That Unifies ZippyDB Traffic and Handles Over 1 Billion Operations Per SecondMarkTechPost2026-09-15T04:28:29Zhttps://www.marktechpost.com/2026/09/14/meta-introduces-zgateway-a-stateless-proxy-tier-that-unifies-zippydb-traffic-and-handles-over-1-billion-operations-per-second/Meta 工程团队推出 ZGateway,一个位于客户端应用与 ZippyDB 之间的无状态代理层,用于统一流量并解决超百万客户端主机的连接泛滥问题。ZippyDB 是 Meta 使用最广的键值存储,支撑产品元数据、计数器和配置,每秒处理数十亿次操作。Agent-net Open Sources Webagent: A Go Harness That Turns Any Website into a Guarded AI AgentMarkTechPost2026-09-15T04:03:20Zhttps://www.marktechpost.com/2026/09/14/agent-net-open-sources-webagent-a-go-harness-that-turns-any-website-into-a-guarded-ai-agent/Agent-net 开源 Webagent,一个用 Go 编写的 harness,可将任意网站转变为受保护的公开 AI Agent,无需编写编排代码。该工具面向其 agent 间市场,让企业 Agent 能与其他 Agent 发现、信任并互相付费,降低企业部署对外 Agent 的门槛。iOS 27 正式版体验:Siri AI 终于开窍了,老 iPhone 升级也有新东西爱范儿2026-09-15T05:00:50Zhttps://www.ifanr.com/1680134?utm_source=rss&utm_medium=rss&utm_campaign=iOS 27 正式版发布,Siri 的 AI 能力迎来显著升级,被评价为“终于开窍”。同时,老款 iPhone 升级后也能获得新功能,整体体验值得升级。造物 100 #06|自动驾驶上轮椅了,口袋相机学会飞行,AI 教练上了雪场极客公园2026-09-15T05:54:51Zhttp://www.geekpark.net/news/370325极客公园「造物 100」第 6 期盘点硬件融合创新产品,指出硬件创新正从新物种转向成熟品类的形态叠加。代表产品包括全球首款手持云台相机兼自拍无人机 HoverAir Versa、自动驾驶智能轮椅等,作者提醒融合创新需回归真实用户价值。前OpenAI后训练VP回应陶哲轩:说AI毁了数学,可能还是太小瞧AI了量子位2026-09-15T05:39:10Zhttps://www.qbitai.com/2026/09/489288.html前OpenAI后训练VP回应陶哲轩关于AI与数学的讨论,认为AI不仅不会毁掉数学,反而可能被低估。他指出未来AI能提出有价值洞见、建立新概念框架,供数学家在此基础上继续探索,角色从解题工具升级为研究伙伴。9月21日,深圳前海!聊聊工业AI与生态共创的下一步量子位2026-09-15T05:20:30Zhttps://www.qbitai.com/2026/09/489277.html西门子Xcelerator繁星生态大会将于9月21日在深圳前海举办,聚焦工业AI与生态共创的下一步。活动围绕生态合作共赢机遇展开,面向关注工业AI落地与产业生态的从业者。qKnow 开源版 v2.4.3 发布:数据接入能力再拓展,知识构建自定义能力上新开源中国2026-09-15T06:04:34Zhttps://www.oschina.net/news/502493qKnow智能体构建平台开源版v2.4.3发布,重点拓展非结构化知识接入与自定义能力。新增JSON/JSONL文件导入知识库与知识图谱、问答数据一键导出,并开放文件解析模型与提示词自定义,完善文档从接入到复用的处理链路。:fire::fire:开源接口平台v6.0发布,支持AI办公MCP接入开源中国2026-09-15T04:06:36Zhttps://www.oschina.net/news/502491开源接口平台ApiGo发布v6.0,新增对AI办公MCP接入的支持,兼容WorkBuddy、千问办公、Trea Work、豆包等平台。平台支持动态数据源、动态SQL与标签,可接入MySQL、Oracle、达梦、TiDB、Hive、DuckDB等多种数据源,在线可视化编写SQL快速发布接口。给 AI 发外设,戴森派摄像头进嘴、绿联给充电宝开了扇窗极客公园2026-09-15T06:01:55Zhttp://www.geekpark.net/news/370328IFA柏林展上AI硬件改造成为主题,戴森推出带1毫米摄像头的牙刷,联想发布跨设备个人智能体Qira。厂商倾向用AI重做牙刷、手表、充电宝等老物件而非发明新物种,手机磁吸接口也催生墨水屏、充电宝等新配件生态。Meta新研究:字节模型蒸馏后,天花板破了量子位2026-09-15T06:37:16Zhttps://www.qbitai.com/2026/09/489337.htmlMeta 新研究发现,对字节跳动模型进行蒸馏后性能天花板被突破。该研究探索了模型蒸馏的新方法,可能为知识蒸馏与模型能力提升提供新思路,对关注模型压缩与能力迁移的研究者有参考价值。豆包工作和飞书,把中国第一个团队 Agent 拉进了工作群爱范儿2026-09-15T06:39:55Zhttps://www.ifanr.com/1680138?utm_source=rss&utm_medium=rss&utm_campaign=豆包工作与飞书联合推出中国首个团队 Agent,并已将其拉入工作群。该 Agent 面向团队协作场景设计,标志着办公 Agent 从个人助理向团队协作方向演进,是国内办公智能体落地的重要一步。智能体什么该记什么不该记?openKylin专家来答开源中国2026-09-15T06:58:40Zhttps://www.oschina.net/news/502494开源中国邀请 openKylin 专家探讨大模型智能体的记忆管理问题。文章指出智能体长期陪伴用户需记住偏好与习惯,但过度记忆会带来敏感信息滞留隐患,什么该记什么不该记直接影响智能体可用性。对话小宇宙 kyth:播客的护城河是真实,AI 无法取代的是人的立场极客公园2026-09-15T07:10:42Zhttp://www.geekpark.net/news/370345小宇宙 CEO Kyth 在访谈中阐述播客的护城河是真实,AI 无法取代人的立场。2025 年小宇宙合作品牌数同比增长 422%,商业收入增长 760%,变现播客数增长 356%,行业正从「小众」走向规模化。Kyth 强调平台目标不是「小而美」而是「强而久」,并举办首届 AI 垂类线下活动。Hacked by CoupDeGrace量子位2026-09-15T07:33:50Zhttps://www.qbitai.com/2026/09/489365.html量子位页面显示被 CoupDeGrace 入侵,属于网站安全事件而非 AI 技术内容。该条目没有提供任何可核验的模型、论文或产品信息,对关注 AI 前沿的读者价值有限。Accelerating Dropless MoE Training in JAX with NVIDIA Transformer EngineNVIDIA Developer Blog2026-09-14T16:39:15Zhttps://developer.nvidia.com/blog/accelerating-dropless-moe-training-in-jax-with-nvidia-transformer-engine/NVIDIA介绍在JAX中结合Transformer Engine加速Dropless MoE训练,避免因丢弃token导致的精度损失。该方案面向DeepSeek、Qwen、Mixtral等MoE架构,提升大规模训练吞吐与效率。Nuance Labs bags $50M in funding to fix the awkwardness of AI avatarsSiliconANGLE2026-09-15T01:56:06Zhttps://siliconangle.com/2026/09/14/nuance-labs-bags-50m-in-funding-to-fix-the-awkwardness-of-ai-avatars/西雅图初创公司 Nuance Labs 完成 5000 万美元 A 轮融资,由 Lightspeed Venture Partners 领投,Accel 等老股东跟投。该公司致力于让 AI 模型在面对面交谈中表现更自然,解决 AI 虚拟形象交互尴尬的问题。Procurement automation startup Aron launches with $8M in fundingSiliconANGLE2026-09-15T00:10:43Zhttps://siliconangle.com/2026/09/14/procurement-automation-startup-aron-launches-with-8m-in-funding/采购自动化初创公司 Aron 正式亮相,累计融资 800 万美元,其中 600 万美元种子轮由 Storm Ventures 领投,Menlo Ventures 领投了更早一轮。该公司利用 AI 简化采购团队工作流程,切入企业采购自动化赛道。Contact center AI ROI shifts toward resolution quality and governed executionSiliconANGLE2026-09-14T22:38:24Zhttps://siliconangle.com/2026/09/14/contact-center-ai-resolution-contactcentersummit/theCUBE Research 分析师指出,联络中心 AI 的 ROI 衡量标准正从机器处理交互数量转向问题实际解决质量与受治理的执行能力。这一转变意味着企业需重新评估 AI 客服部署的价值指标。OpenAI reportedly buys AI camera startup Glass Imaging for more than $300MSiliconANGLE2026-09-14T22:28:01Zhttps://siliconangle.com/2026/09/14/openai-reportedly-buys-ai-camera-startup-glass-imaging-for-more-than-300m/据报道,OpenAI 以超过 3 亿美元收购智能手机相机软件初创公司 Glass Imaging,双方尚未公开确认。此举正值 OpenAI 推进消费硬件布局之际,此前其曾以 65 亿美元股票进行收购。AI adoption outruns readiness as contact centers chase end-to-end resolutionSiliconANGLE2026-09-14T21:28:52Zhttps://siliconangle.com/2026/09/14/customer-service-ai-adoption-outpaces-orchestration-contactcentersummit/尽管 AI 已渗透几乎所有客服运营环节,多数部署仍停留在单一聊天机器人或人工坐席辅助面板阶段。协调数据、系统与人员实现端到端问题解决的能力,正成为企业 AI 落地的分水岭。Flam raises $40M in funding to make AI-enabled interactive content a realitySiliconANGLE2026-09-14T16:00:06Zhttps://siliconangle.com/2026/09/14/flam-raises-40m-in-funding-to-make-ai-enabled-interactive-content-a-reality/互动内容初创公司 Flam 完成 4000 万美元 B 轮融资,由 QED Investors 领投,Claypond Capital 等参投。该公司称在隐身模式下已积累可观用户 traction,致力于用 AI 实现互动内容规模化。什么样的数据库底座,能加速 Agent 从 Demo 走向生产?InfoQ 中文2026-09-15T14:39:55Zhttps://www.infoq.cn/video/CNlXsz2yMZpLvdwMlhXY?utm_source=rss&utm_medium=article文章探讨Agent从Demo走向生产需要什么样的数据库底座,涉及状态管理、记忆存储与高并发读写等需求。核心观点是传统数据库难以直接支撑Agent长时任务,需针对性选型与架构设计。Python 拥抱 RISC-V:CPython 正式纳入 Tier 3 平台InfoQ 中文2026-09-15T14:34:00Zhttps://www.infoq.cn/article/ipaJ5VXPgUiMFmaAgAEG?utm_source=rss&utm_medium=articleCPython正式将RISC-V纳入Tier 3支持平台,意味着官方开始为该架构提供基础构建与测试保障。这为RISC-V生态补齐主流语言运行时短板,利好国产芯片与开源硬件发展。HTTP 新增 QUERY 方法:有人叫好,也有人质疑“这不就是 GET?”InfoQ 中文2026-09-15T13:00:00Zhttps://www.infoq.cn/article/BmJh0DzGPYBEl1zlyO0C?utm_source=rss&utm_medium=articleHTTP标准新增QUERY方法,支持带请求体的安全查询语义,引发社区热议,有人叫好也有人质疑其与GET的边界。该提案若落地将影响API设计与缓存、幂等性等工程实践。Meta 打造“组织第二大脑”智能体的设计思路InfoQ 中文2026-09-15T11:21:00Zhttps://www.infoq.cn/article/4OXJdfB36TpMRdvrVgIc?utm_source=rss&utm_medium=articleMeta分享了打造“组织第二大脑”智能体的设计思路,目标是让Agent理解并调用企业内部知识与协作流程。该实践为企业级Agent落地提供了知识组织、权限与检索方面的参考架构。从 Trace 到规模化实时评估:面向生产流量的 Agent 可观测实践|QCon上海InfoQ 中文2026-09-15T10:08:44Zhttps://www.infoq.cn/article/556HrGKWUqWSg7NM3YT3?utm_source=rss&utm_medium=articleQCon上海议题聚焦生产环境Agent的可观测实践,从Trace采集到规模化实时评估,覆盖链路追踪、指标监控与质量评估。内容面向已上线Agent的团队,强调用数据驱动迭代与故障定位。在金融支付系统中实施混沌工程:来自企业级 ECS 部署的经验教训InfoQ 中文2026-09-15T09:04:00Zhttps://www.infoq.cn/article/I6k1mOtQ9fltk7Ep1hZE?utm_source=rss&utm_medium=article文章总结金融支付系统在企业级ECS部署中实施混沌工程的经验教训,涵盖故障注入、爆炸半径控制与演练流程。对高可用要求极高的支付场景,提供了可复用的稳定性治理方法。AI 负责创造,人来干脏活,这事儿能否停一下?InfoQ 中文2026-09-15T00:08:00Zhttps://www.infoq.cn/article/CKzbmAxb1lLuu4geZuHy?utm_source=rss&utm_medium=article文章批评当前“AI负责创造、人类干脏活”的协作模式,指出大量标注、清洗与审核工作被转嫁给人工。作者呼吁重新审视人机分工,避免把AI落地的隐性成本转嫁给一线劳动者。Token账单异常,可能不只是成本失控InfoQ 中文2026-09-14T21:58:16Zhttps://www.infoq.cn/article/AcvXqsA1IGC3ACxJSgP6?utm_source=rss&utm_medium=article文章指出Token账单异常往往不只是成本失控,可能反映调用链路、缓存命中或Agent行为异常。建议把Token消耗作为可观测指标,用于发现模型滥用、死循环与提示词设计问题。发长文预警 AI 风险后,Dario 首次专访回应:AI 不能停,但必须慢下来InfoQ 中文2026-09-14T21:54:49Zhttps://www.infoq.cn/article/fsZQ39K4Cd79vaUkFz7F?utm_source=rss&utm_medium=articleAnthropic CEO Dario在发长文预警AI风险后首次接受专访,回应称AI不能停但必须慢下来。他主张在推进能力的同时加强安全研究与治理,代表头部AI公司对发展节奏的审慎立场。Arm 推出 AI Portal:当 AI 应用从“模型可用”走向“平台可用”InfoQ 中文2026-09-14T21:50:38Zhttps://www.infoq.cn/article/xD9oWbebhcjwgHz1oEfa?utm_source=rss&utm_medium=articleArm推出AI Portal,定位从“模型可用”走向“平台可用”,为开发者提供模型部署、优化与运行支持。此举意在把Arm架构打造成端侧与边缘AI应用的统一平台,强化生态竞争力。Azure 虚拟桌面混合版正式可用,许可细则尚未公布InfoQ 中文2026-09-14T17:29:00Zhttps://www.infoq.cn/article/MMD3SrhB1HuUh5Rv9Fmw?utm_source=rss&utm_medium=articleAzure虚拟桌面混合版正式可用,支持在混合云环境下交付虚拟桌面,但许可细则尚未公布。企业可借此统一管理本地与云上桌面,不过成本与授权方式仍待明确。堆GPU已过时?英特尔将在苏州开讲智能体时代AI工厂,速速来报名开源中国2026-09-15T08:32:03Zhttps://www.oschina.net/news/502498英特尔将在苏州举办活动,宣讲智能体时代AI工厂,覆盖云端、边缘与PC全场景及Token生产流通消费全周期。活动联合生态伙伴展示CPU、GPU、存储等算力方案,指向AI基础设施的下一站。DeepSeek 又又又崩了?教你怎么做模型故障转移开源中国2026-09-15T04:08:32Zhttps://www.oschina.net/news/502492DeepSeek深夜再次出现服务崩溃,影响无人值守的自动任务,文章借此介绍模型故障转移方案。以Firefly Router为例,只需一行代码即可配置备用模型,降低单一模型不可用带来的业务风险。阶跃星辰发布 Step Audio 3 系列语音模型,多款上榜全球第一开源中国2026-09-15T08:56:24Zhttps://www.oschina.net/news/502502/step-audio-3阶跃星辰发布 StepAudio 3 系列语音模型,一次性推出 Realtime、ASR、TTS、Gen、Music 五款模型。其中 Realtime 模型在 Artificial Analysis 的 Conversational Dynamics 榜单上以 98.9% 的综合得分登顶全球第一,标志着语音大模型竞争从文本转语音转向对声音的深度理解与组织。Not everyone is convinced that Big AI's proposed development slowdown is really about safetyThe Decoder2026-09-15T09:04:36Zhttps://the-decoder.com/not-everyone-is-convinced-that-big-ais-proposed-development-slowdown-is-really-about-safety/OpenAI、Anthropic和谷歌以安全为由呼吁放缓前沿AI开发,但遭到业界与政界质疑。Cohere CEO称其为“换汤不换药的卡特尔”,白宫与特朗普也公开反对,认为此举意在排挤竞争对手。Hacked by CoupDeGrace量子位2026-09-15T07:58:38Zhttps://www.qbitai.com/2026/09/489371.html量子位页面被黑客组织CoupDeGrace入侵并篡改标题,未提供任何AI技术内容。该事件属于网站安全事件,与AI前沿进展无关,但反映出AI媒体平台自身的安全防护存在漏洞。号称人类造的最后一个 AI 要来了,刷屏全网的 RSI 是什么爱范儿2026-09-15T09:43:19Zhttps://www.ifanr.com/1679813?utm_source=rss&utm_medium=rss&utm_campaign=爱范儿解读了近期刷屏的RSI(递归自我改进)概念,即AI能够自主改进自身算法与架构,被视为通向"智能爆炸"的关键路径。文章梳理了相关技术设想与现实差距,指出当前AI距离真正的递归自我改进仍有明显距离,并讨论了这一方向的安全与伦理争议。What must happen for AI’s trillion-dollar gamble to pay offMIT Tech Review AI2026-09-15T10:00:00Zhttps://www.technologyreview.com/2026/09/15/1144028/ai-infrastructure-boom-investment-bubble-risk/MIT Tech Review探讨AI万亿美元级投资能否兑现回报,以宾大沃顿商学院金融教授Jessica Wachter的分析为切入。文章指出AI对经济的影响面临大量商业与技术不确定性,但少数头部企业的资本投入规模本身已是不可争议的事实。🔥🔥智博会直击|开源中国受邀分享「甬动开源·星火征集令」正式发布开源中国2026-09-15T09:59:43Zhttps://www.oschina.net/news/502504开源中国在第十六届智博会工业软件开源根技术专题活动上分享All4AI开源社区建设经验,并发布「甬动开源·星火征集令」宁波开源项目加速计划。该计划旨在推动地方开源生态与AI产业结合,由开源中国副总裁李晨现场发布。Apple brings a fully revamped Siri built on Google's Gemini, but not to the EUThe Decoder2026-09-15T10:33:03Zhttps://the-decoder.com/apple-brings-a-fully-revamped-siri-built-on-googles-gemini-but-not-to-the-eu/苹果正式推出基于 Google Gemini 重建的 Siri AI,部分在端侧运行、部分依托 Private Cloud Compute,早期测试者称赞多步请求与屏幕上下文能力,但也报告幻觉和个人上下文缺失问题。该助手暂不在欧盟上线,显示苹果在 AI 能力与合规之间仍面临取舍。一张GPU跑10万原子!分子之心用AI把化学反应“拍”成了电影量子位2026-09-15T09:58:00Zhttps://www.qbitai.com/2026/09/489381.html分子之心利用 AI 技术实现单张 GPU 上模拟 10 万原子级别的分子动力学,打破分子模拟领域精度、速度与规模的不可能三角。该突破有望将化学反应过程以电影级精度呈现,加速药物研发与材料科学发现。6500 美元的双臂人形机械臂,OpenArm 把硬件开源做到能复现开源中国2026-09-15T11:26:10Zhttps://www.oschina.net/news/502506OpenArm 推出全开源 7 自由度双臂人形机械臂,整套系统售价 6500 美元,定位为物理 AI 提供可全球复现的实验硬件平台。其激进定价和开源策略旨在打破硬件定制化壁垒,推动具身智能研究从软件开源走向硬件可复现。无问芯穹联合清华、上交正式开源具身端侧推理引擎APXInf,Pi 0.5性能SOTA量子位2026-09-15T10:43:28Zhttps://www.qbitai.com/2026/09/489460.html无问芯穹联合清华、上交开源具身端侧推理引擎APXInf,在Pi 0.5上取得SOTA性能。该引擎瞄准具身智能规模化落地的“最后一公里”,有望降低端侧部署门槛,推动具身智能从实验室走向实际应用。全球AI视频榜单第一梯队再添中国力量:智象发布首款物理规律导向视频模型量子位2026-09-15T10:41:06Zhttps://www.qbitai.com/2026/09/489389.html智象未来发布首个原生全模态视频生成模型HiDream-O1-Video-1.0,主打物理规律导向。该模型跻身全球AI视频榜单第一梯队,代表中国力量在视频生成赛道的重要突破,有望提升生成视频的物理一致性与真实感。华为发布全球首个3D数据中心,携手产业共建AIDC新范式开源中国2026-09-15T11:57:16Zhttps://www.oschina.net/news/502507华为在芜湖发布全球首个3D数据中心,并发布《3D数据中心》专著、开放概要设计图库,携手产业共建AIDC新范式。该方案通过系统架构创新解决大型AI算力中心的安全性与跨代际AI芯片兼容性问题,对AI算力基础设施演进具有标志性意义。Apache DolphinScheduler 3.4.3 发布!开源中国2026-09-15T10:31:08Zhttps://www.oschina.net/news/502505Apache DolphinScheduler 3.4.3正式发布,围绕调度、权限、安全、性能和稳定性持续优化,修复任务实例与工作流实例查询、API权限控制、敏感信息保护、任务失败恢复等生产场景问题。3.5.0版本预计新增调度补火策略。Salesforce and Nvidia’s new reasoning model is everything the AI labs should fearTechCrunch AI2026-09-15T12:00:00Zhttps://techcrunch.com/2026/09/15/salesforce-and-nvidias-new-reasoning-model-is-everything-the-ai-labs-should-fear/TechCrunch评论指出,Salesforce与Nvidia联合推出的推理模型Koa基于Nvidia开源权重Nemotron构建,专攻销售、营销与客户支持任务。文章认为这类垂直专用模型正是通用AI实验室最应警惕的方向,可能蚕食其企业市场份额。Salesforce debuts Koa, a specialized model built to reason about CRM dataSiliconANGLE2026-09-15T12:00:33Zhttps://siliconangle.com/2026/09/15/salesforce-debuts-koa-a-specialized-model-built-to-reason-over-crm-data/Salesforce在Dreamforce大会上宣布与Nvidia合作推出Koa,一款专为CRM数据推理打造的专用AI模型。Koa基于Nvidia的Nemotron模型架构,旨在帮助AI Agent完成复杂的多步骤推理任务,覆盖销售、营销和客户支持场景。Agility Robotics says its new Digit 5 robot can work next to people without safety fencesThe Decoder2026-09-15T12:57:10Zhttps://the-decoder.com/agility-robotics-says-its-new-digit-5-robot-can-work-next-to-people-without-safety-fences/Agility Robotics 发布新一代人形机器人 Digit 5,面向仓库和工厂场景。其最大亮点是无需安全围栏即可与人类并肩工作,意味着人机协作安全能力显著提升,有望降低部署成本并加速人形机器人在物流制造中的商业化落地。New insights from Google’s AI & Economy ATLASGoogle AI Blog2026-09-15T13:00:00Zhttps://blog.google/innovation-and-ai/technology/ai/ai-economy-atlas-september-2026/Google发布AI与经济ATLAS v1.0 2026报告,系统梳理AI对经济的影响。该报告由Google AI团队推出,旨在为政策制定者和研究者提供AI经济影响的量化洞察与数据支撑。Early Anthropic hire, former METR COO have found a way to rein in rogue AI agentsTechCrunch AI2026-09-15T13:00:00Zhttps://techcrunch.com/2026/09/15/early-anthropic-hire-former-metr-coo-have-found-a-way-to-rein-in-rogue-ai-agents/Anthropic早期员工与前METR COO联合创立AIUC公司,致力于管控失控AI Agent,已完成4000万美元A轮融资,由Ribbit Capital领投。该方向聚焦AI Agent安全与风险承保,属于安全对齐领域的新兴商业化尝试。Startup Evvy raises $40M to accelerate precision diagnostics and medicine for women’s healthSiliconANGLE2026-09-15T13:00:54Zhttps://siliconangle.com/2026/09/15/ai-startup-evvy-raises-40m-to-accelerate-precision-diagnostics-and-medicine-for-womens-health/AI女性健康初创公司Evvy完成4000万美元B轮融资,由Catalio Capital Management领投。资金将用于扩展其精准诊断和护理平台,加速AI驱动的女性健康医疗方案落地。Startup Keewano launches agent-focused database and pulls in $12M in fundingSiliconANGLE2026-09-15T13:00:32Zhttps://siliconangle.com/2026/09/15/startup-keewano-launches-agent-focused-database-and-pulls-in-12m-in-funding/以色列数据库初创公司Keewano推出面向AI Agent的事件型数据库KeewanoDB,可为智能体提供实时上下文以支持分析与决策。公司同时宣布获得1200万美元融资,由Hetz Ventures和a16z Speedrun等参投。19.98 万元起,吉利银河战舰 700 开启预售,最高 1129 匹马力,还有三电机四驱爱范儿2026-09-15T13:04:35Zhttps://www.ifanr.com/1680277?utm_source=rss&utm_medium=rss&utm_campaign=吉利银河战舰700开启预售,起售价19.98万元,最高输出1129匹马力,配备三电机四驱系统。该车定位硬派越野风格,车顶帐篷等户外配件成为亮点,主打户外露营场景。This doorbell camera lets a human security guard watch your front doorThe Verge AI2026-09-15T13:36:45Zhttps://www.theverge.com/tech/995365/simplisafe-video-doorbell-series-2-virtual-guard-price-specsThe Verge报道SimpliSafe推出第二代视频门铃,售价199.99美元,配合每月49.99美元起的Active Guard Outdoor Protection服务,将AI分析与真人安保人员结合,主动检测和响应门前潜在威胁。这体现了AI+人工混合安防在消费级家居场景的落地。首个AIGC长片大赛!RunningHub单项大奖100万,科幻IP免费改编量子位2026-09-15T12:48:48Zhttps://www.qbitai.com/2026/09/489260.html量子位报道首个AIGC长片大赛启动,由RunningHub主办,单项大奖高达100万元,并开放科幻IP免费改编,刘慈欣参与督战。该赛事旨在推动AI生成内容在长片电影领域的应用,标志着AIGC从短片向长片创作迈进。手机替我跑了一整套流程!我就说了一句话,AI执行了100步量子位2026-09-15T12:47:16Zhttps://www.qbitai.com/2026/09/489466.html量子位报道荣耀YOYO智能体实现一句话执行100步操作,可全面接管用户手机上的复杂流程。这展示了AI Agent在移动端自动化任务中的能力,从简单指令到多步骤执行,推动手机智能助手向自主代理演进。Discover how to take your startup from prototype to production at TechCrunch Disrupt 2026TechCrunch AI2026-09-15T14:30:00Zhttps://techcrunch.com/2026/09/15/discover-how-to-take-your-startup-from-prototype-to-production-at-techcrunch-disrupt-2026/TechCrunch Disrupt 2026将举办专题讨论,邀请Foxglove、MBRYONICS、Bedrock Robotics等公司负责人分享创业公司如何从原型走向量产。9月25日前注册可省200美元门票。4 days left to exhibit at TechCrunch Disrupt 2026TechCrunch AI2026-09-15T14:00:00Zhttps://techcrunch.com/2026/09/15/4-days-left-to-exhibit-at-techcrunch-disrupt-2026/TechCrunch Disrupt 2026展会参展报名仅剩4天,截止9月18日。活动将于10月13-15日举行,预计吸引超1万名创始人、投资者及科技领袖参与。After warning AI is too dangerous, Bill Gates bets a billion on its upsideThe Decoder2026-09-15T14:26:48Zhttps://the-decoder.com/after-warning-ai-is-too-dangerous-bill-gates-bets-a-billion-on-its-upside/盖茨基金会宣布两年内投入至少10亿美元,推动AI在健康、教育、农业领域的普及。比尔·盖茨同时警告AI训练数据超90%为英文,语音识别在约鲁巴语中失败率高达60%,市场难以保障机会平等。梁文锋CFO到位!投过智谱MiniMax量子位2026-09-15T13:53:39Zhttps://www.qbitai.com/2026/09/489707.htmlDeepSeek创始人梁文锋迎来新任CFO严文韬,其1991年出生,此前为高瓴创投合伙人,曾投资智谱、MiniMax等AI公司。此举或意味着DeepSeek在资本运作与商业化布局上加速。地平线第1500万颗征程芯片搭载大众 ID. AURA T6,HSD V2.1 即将推出量子位2026-09-15T13:32:54Zhttps://www.qbitai.com/2026/09/489698.html地平线宣布第1500万颗征程芯片已搭载于大众ID. AURA T6车型,同时HSD V2.1智驾方案即将推出,首发全场景倒车能力。这标志着国产智驾芯片量产规模再创新高。Scaling Federated Learning Across Docker, Kubernetes, and Slurm with NVIDIA FLARENVIDIA Developer Blog2026-09-15T15:00:00Zhttps://developer.nvidia.com/blog/scaling-federated-learning-across-docker-kubernetes-and-slurm-with-nvidia-flare/NVIDIA 介绍如何用 FLARE 将联邦学习从单服务器扩展到 Docker、Kubernetes 和 Slurm 等异构环境。该方案支持跨站点、跨集群的大规模联邦训练,降低部署与运维复杂度。对关注隐私计算和分布式 AI 基础设施的开发者有实用价值。Meta’s new One subscriptions put a price on social media and AIThe Verge AI2026-09-15T15:00:00Zhttps://www.theverge.com/tech/995453/meta-one-subscriptions-aiMeta 推出 Meta One 订阅套餐,将社交应用订阅与额外 AI 使用额度打包,面向个人、创作者和企业提供多档选择。此举把社交媒体与 AI 能力直接货币化,反映大厂正加速探索 AI 订阅商业模式。AEO startup Profound hits unicorn valuation, raises $180M Series D 7 months after last roundTechCrunch AI2026-09-15T15:22:48Zhttps://techcrunch.com/2026/09/15/aeo-startup-profound-hits-unicorn-valuation-raises-180m-series-d-7-months-after-last-round/AEO 初创公司 Profound 完成 1.8 亿美元 D 轮融资,估值达 18 亿美元,距离上一轮 9600 万美元 C 轮仅约七个月。快速融资和独角兽估值显示,面向 AI 搜索与答案引擎优化的赛道正受到资本高度追捧。Former TikTok execs built an app that uses AI to teach you how to pose for a photoTechCrunch AI2026-09-15T14:42:37Zhttps://techcrunch.com/2026/09/15/former-tiktok-execs-built-an-app-that-uses-ai-to-teach-you-how-to-pose-for-a-photo/前 TikTok 高管推出相机应用 Superpose,利用 AI 分析自拍或照片并生成四种可选拍照姿势。该产品把生成式 AI 用于日常摄影指导,体现 AI 消费级应用正从修图向实时创意辅助延伸。OpenAI, Anthropic, Google have been in talks on AI safety for weeksTechCrunch AI2026-09-15T15:47:03Zhttps://techcrunch.com/2026/09/15/openai-anthropic-google-have-been-in-talks-on-ai-safety-for-weeks/OpenAI 证实已与 Anthropic、Google DeepMind 就 AI 安全议题进行了数周会谈,显示头部实验室在安全治理上寻求协调。与此同时,特朗普团队淡化安全担忧,主张加快进度以跟上中国,凸显安全与竞争之间的政策张力。全能 Go Agent 框架 covonaut v1.1.3 发布:TUI 库迎来更人性化的交互开源中国2026-09-15T15:03:42Zhttps://www.oschina.net/news/502508Go 语言生产级 Agent 框架 covonaut 发布 v1.1.3,基于 Go 1.25 构建并以 MIT 协议开源。框架覆盖 Agent 循环、工具注册、MCP 协议桥接、A2A 多智能体协作、图引擎与会话管理等能力,本次更新聚焦终端界面交互优化,提升了 TUI 使用体验。