infoAI 日报 2026-09-092026年09月09日143122论文 75 / 官方 5 / 英文媒体 40 / 中文媒体 23本页聚合 AI 前沿信息:arXiv 论文、OpenAI/DeepMind/Meta/HuggingFace 官方博客、国内外 AI 媒体,均为最近 7 天内发布,附中文摘要与重要度评级。Google Cloud races to catch up in the AI deployment wars with Accenture dealTechCrunch AI2026-09-08T16:20:31Zhttps://techcrunch.com/2026/09/08/google-cloud-races-to-catch-up-in-the-ai-deployment-wars-with-accenture-deal/Google Cloud 与埃森哲达成合作,以加速企业 AI 部署,通过派驻工程师解决采用瓶颈。此举旨在追赶竞争对手,强化其在企业 AI 市场的竞争力。OpenAI Just Claimed a Huge Math Discovery. Some Academics Are Crying FoulWired AI2026-09-08T16:42:05Zhttps://www.wired.com/story/openai-navier-stokes-math-discovery-academics/OpenAI宣布了一项重大数学发现,但被学术界指控存在不当行为,引发争议。该公告被视为前沿AI领域的里程碑,但质疑声可能影响其可信度。A new class action lawsuit questions whether Anthropic broke the law by misleading power usersThe Verge AI2026-09-08T17:27:31Zhttps://www.theverge.com/ai-artificial-intelligence/990313/anthropic-class-action-lawsuit-pricing-subscription-plansAnthropic因优先服务高价值用户而切断OpenClaw等应用,现遭集体诉讼,指控其误导顶级订阅用户,使其对服务期望过高。诉讼称用户未获得承诺的更高价值,凸显商业策略与用户权益的冲突。OpenAI researcher allegedly pressured mathematician to drop Anthropic co-author from math breakthrough paperThe Decoder2026-09-08T17:23:04Zhttps://the-decoder.com/openai-researcher-allegedly-pressured-mathematician-to-drop-anthropic-co-author-from-math-breakthrough-paper/数学家Tristan Buckmaster指控OpenAI施压,要求其从Navier-Stokes方程突破性论文中移除Anthropic联合作者,并威胁他。OpenAI声称独立取得相同成果,但Buckmaster质疑其模型训练数据使用,引发对AI辅助研究伦理和竞争行为的争议。OpenAI fought dirty on career-making math problem, says NYU mathematicianTechCrunch AI2026-09-08T17:32:15Zhttps://techcrunch.com/2026/09/08/openai-fought-dirty-on-career-making-math-problem-says-nyu-mathematician/OpenAI被指控在千禧年大奖难题Navier-Stokes问题上采取不正当竞争手段,该问题悬赏100万美元。NYU数学家指责OpenAI在解题竞赛中行为不端,可能涉及利用资源或规则漏洞,引发学术公平性争议。Meta bets on AI agent Muse to catch up in AI raceThe Verge AI2026-09-08T19:00:00Zhttps://www.theverge.com/ai-artificial-intelligence/991216/meta-bets-on-ai-agent-muse-to-catch-up-in-ai-raceMeta 推出 AI 助手 Muse,旨在让 AI 触达更广泛用户,这是其数十亿美元战略调整的一部分,以追赶 AI 竞赛中的落后位置。Muse 是个人助理产品,标志着 Meta 在 AI 商业化上的新尝试。Google DeepMind Releases AlphaGenome Atlas With Precomputed Molecular Effect Predictions and AVI Scores for 9 Billion Human DNA VariantsMarkTechPost2026-09-08T19:00:09Zhttps://www.marktechpost.com/2026/09/08/google-deepmind-releases-alphagenome-atlas-with-precomputed-molecular-effect-predictions-and-avi-scores-for-9-billion-human-dna-variants/Google DeepMind 发布了 AlphaGenome Atlas,这是一个包含 90 亿个人类 DNA 变异预计算分子效应预测和 AVI 分数的资源。该图谱为每个单字母变化提供影响评分,有助于理解基因组变异。Meta debuts its Muse AI agent. Will consumers trust it?TechCrunch AI2026-09-08T19:00:00Zhttps://techcrunch.com/2026/09/08/meta-debuts-its-muse-ai-agent-will-consumers-trust-it/Meta推出个人AI代理Muse,需访问用户邮件、日历、支付和健康服务等数据,这是其最大的消费级AI押注,也是对用户是否仍信任Meta处理数据的重大考验。此举凸显AI代理商业化中隐私信任的关键挑战。NVIDIA Announces CUDA Rust with cuda-oxide (SIMT) and cutile-rs (Tile) for Compile-Time-Safe GPU KernelsMarkTechPost2026-09-08T19:51:54Zhttps://www.marktechpost.com/2026/09/08/nvidia-announces-cuda-rust-with-cuda-oxide-simt-and-cutile-rs-tile-for-compile-time-safe-gpu-kernels/NVIDIA宣布推出CUDA Rust,旨在让Rust成为GPU内核的一等公民语言。两个开源NVlabs项目覆盖两种CUDA编程模型:cuda-oxide通过Pliron和LLVM将Rust MIR编译为PTX,支持SIMT内核;cutile-rs在稳定Rust 1.89+上通过CUDA Tile IR即时编译Tile内核。此举有望提升GPU编程的编译期安全性。How GPT-5.6 Sol helps run quantum computing experimentsOpenAI Blog2026-09-08T17:00:00Zhttps://openai.com/index/codex-quantum-computing-experimentsOpenAI 博客展示了 GPT-5.6 Sol 与 Codex 在量子计算实验中的自主应用。MIT 研究员利用其自动运行实验、分析结果并校准量子比特,显著提升了科研效率。这标志着大模型在专业科学计算领域的深度渗透。ChatGPT Sketch turns your bad drawings into detailed AI imagesThe Verge AI2026-09-08T20:16:09Zhttps://www.theverge.com/ai-artificial-intelligence/991727/openai-chatgpt-images-2-5-sketchOpenAI 发布 ChatGPT Images 2.5,并推出名为 Sketch 的新功能,允许用户直接在 ChatGPT 中绘制草图来指导图像生成。该功能降低了图像创作门槛,使非专业用户也能通过简单涂鸦获得精细的 AI 图像。Meta Releases Muse, a Personal AI Agent With Privacy ‘Built Into It’Wired AI2026-09-08T20:12:51Zhttps://www.wired.com/story/meta-releases-muse-a-personal-ai-agent-with-privacy-built-into-it/Meta 发布个人 AI 代理 Muse,强调内置隐私保护,旨在与 OpenClaw 和 Instinct 竞争。Muse 能执行卖车、预订机票等复杂任务,展示了 AI 代理在日常生活服务中的广阔应用前景。Drama swirls around OpenAI’s legendary mathematical milestoneThe Verge AI2026-09-08T20:53:52Zhttps://www.theverge.com/ai-artificial-intelligence/991710/openai-navier-stokes-solutionOpenAI宣称解决了困扰约90年的Navier-Stokes数学难题,该问题涉及流体动力学。此消息引发热议,但尚未经同行评审验证,其真实性和学术意义待确认。若属实,将推动AI在科学发现领域的应用。Hackers are stealing Claude tokens from subscribersTechCrunch AI2026-09-08T21:10:27Zhttps://techcrunch.com/2026/09/08/hackers-are-stealing-claude-tokens-from-subscribers/黑客正窃取Claude订阅用户的令牌,导致账户在未使用时消耗资源。Anthropic已就此向用户发出警告,提醒注意账户安全。Cognition hits $48B valuation, signaling investors believe AI coding is far from a winner-take-all marketTechCrunch AI2026-09-08T21:04:06Zhttps://techcrunch.com/2026/09/08/cognition-hits-48b-valuation-signaling-investors-believe-ai-coding-is-far-from-a-winner-take-all-market/Cognition估值达480亿美元,表明投资者认为AI编程市场并非赢家通吃。其估值倍数高于Cursor被SpaceX收购前的水平,凸显该领域竞争激烈且潜力巨大。早报|库克看到华为三星后,推动苹果加速研发折叠屏iPhone/小米中折叠「卖爆了」,首销增长310%/《旅行青蛙・中国之旅》12月8日停运爱范儿2026-09-09T00:19:18Zhttps://www.ifanr.com/1678959?utm_source=rss&utm_medium=rss&utm_campaign=本批早报涵盖科技与商业动态,包括苹果因竞品压力加速研发折叠屏iPhone,小米中折叠屏手机首销增长310%,以及《旅行青蛙》停运。此外提及DeepSeek内测V4.1 Flash、车企供应商账期监管和微信PC版接入AI助手等消息。折叠屏 iPhone 初期产量受限,每日仅数百部;环比增长 379%,腾讯 HY4 登顶全球大模型调用榜;特斯拉时隔 19 个月再降价|极客早知道极客公园2026-09-09T00:37:42Zhttp://www.geekpark.net/news/370026苹果折叠屏iPhone因严格质量管控,初期日产量仅数百部,可能难以满足市场需求,但计划年内生产800万至1000万部。同时,OpenAI发布ChatGPT Images 2.5图像生成模型,延迟降低50%,新增Sketch草图功能,提升细节和光照表现。JimuReport 积木报表 v2.5.2 版本发布,免费开源的 AI 报表工具开源中国2026-09-09T01:26:07Zhttps://www.oschina.net/news/502389积木报表 v2.5.2 发布,主打 AI 自动生成报表与数据大屏,支持对话式修改。工具免费开源,提供类 Excel 拖拽设计器,兼容 30 余种数据源,适合快速搭建复杂报表场景。EasyGoAdmin 敏捷开发框架 GoFrame+AntdVue 版本 v2.7.1 发布开源中国2026-09-09T01:17:09Zhttps://www.oschina.net/news/502387EasyGoAdmin v2.7.1 发布,主要修复近期用户反馈问题。该框架基于 GoFrame、Vue3 等构建,采用模块化插件化设计,旨在简化前后端分离后台管理系统的开发流程。灵界 OS v5.0 正式发布:全英文适配已完成,系统全面国际化开源中国2026-09-08T23:09:29Zhttps://www.oschina.net/news/502386灵界 OS v5.0 正式发布,完成全英文适配并实现界面国际化,支持一键切换中英文。系统界面所有元素均已英文化,且中英文环境独立运行,不影响已安装应用。Termexo v0.8.3 发布:优化终端输入响应,支持任务中途追加指令开源中国2026-09-08T17:50:58Zhttps://www.oschina.net/news/502385Termexo v0.8.3 发布,优化终端输入响应并支持任务中途追加指令,解决多 Agent 运行时的输入卡顿问题。该工具为 MIT 开源的 Windows 多 Agent 工作台,统一管理 Claude Code、Codex CLI 等。宜宾,一场机器人“招聘会”的产业雄心量子位2026-09-09T02:15:54Zhttps://www.qbitai.com/2026/09/486038.html宜宾举办机器人“招聘会”,55支团队参与展示,反映中国地方产业对机器人技术的重视和布局。活动旨在推动机器人产业落地,可能涉及制造业升级和区域经济转型,但具体技术细节未披露。Meta 发布个人 AI 智能体 Muse,住在一台你看不见的虚拟机里开源中国2026-09-09T03:25:02Zhttps://www.oschina.net/news/502392/meta-ai-museMeta 发布个人 AI 智能体 Muse,定位为 agent 而非聊天机器人或助手,能在用户退出应用后持续执行任务,如监控天气并提醒。该应用已上线 App Store、Google Play 和 WhatsApp,标志着 Meta 在个人化 AI 代理领域的商业化推进。What OpenAI’s latest controversy tells us about the future of mathMIT Tech Review AI2026-09-09T03:10:08Zhttps://www.technologyreview.com/2026/09/08/1143747/what-openais-latest-controversy-tells-us-about-the-future-of-math/OpenAI 宣称其智能体解决了千禧年大奖难题之一,但该数学里程碑声明迅速陷入争议,被指控存在夸大或方法缺陷。此事件引发对 AI 在数学领域未来角色及验证标准的深层讨论。ChatGPT Images 2.5 发布,OpenAI 把图像生成的重注押在了编辑上开源中国2026-09-09T03:39:10Zhttps://www.oschina.net/news/502393/openai-chatgpt-images-2-5OpenAI 发布 ChatGPT Images 2.5,强调图像编辑能力而非参数堆叠,每周生成量达 30 亿张,已成全球最大 AI 图像服务之一。核心改进聚焦参考图稳定性和精确编辑等五维度,凸显商业化应用导向。SkyProduction限免活动第二期:MiniMax H3会员限时免费无限用!量子位2026-09-09T03:39:58Zhttps://www.qbitai.com/2026/09/486052.htmlSkyProduction推出第二期限免活动,与阿里巴巴通义万相合作,在8月28日至9月1日期间提供Wan 3.0模型的限时免费使用,且MiniMax H3会员也无限免费。此举旨在吸引用户体验新模型,促进AI工具普及。办公 Agent 大乱战,新势力TeleAgent 凭什么坐上牌桌爱范儿2026-09-09T04:00:01Zhttps://www.ifanr.com/1679152?utm_source=rss&utm_medium=rss&utm_campaign=本文探讨了办公Agent领域的激烈竞争,重点介绍了新势力TeleAgent如何切入市场。文章分析了TeleAgent在功能、体验或技术上的差异化优势,并讨论了其成为国民级AI办公助理的潜力与挑战。Meta Introduces Muse, a Personal AI Agent That Runs on Its Own Dedicated Secure Cloud ComputerMarkTechPost2026-09-09T04:38:13Zhttps://www.marktechpost.com/2026/09/08/meta-introduces-muse-a-personal-ai-agent-that-runs-on-its-own-dedicated-secure-cloud-computer/Meta推出个人AI代理Muse,能执行发送邮件、预订旅行、协商账单等行动,而非仅回答问题。它可在应用关闭后持续工作,仅在需要批准时返回,且每个用户拥有专属安全云计算机,强调隐私与长期目标追踪。具身机器人能搞定超市盘点吗?全球七万门店正在给出答案量子位2026-09-09T04:52:12Zhttps://www.qbitai.com/2026/09/486280.html本文报道具身机器人在超市盘点场景的落地进展,全球七万门店正验证其实际效果。两家公司推动具身智能从演示走向货架,解决算账等具体问题,体现技术商业化潜力。Beyond Right and Wrong: Evaluating Second-order Social Reasoning in Large Language ModelsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05437提出评估LLM二阶社会推理(元规范)的新框架,涵盖规范执行预期。CriticGen: Generation-Aware Evaluation as Actionable FeedbackarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05439提出CriticGen,一种生成感知的细粒度评估框架,提供可操作的反馈以改进模型输出。When Does Memory Help? A Cost-Aware Evaluation of Long-Term Memory in Tool-Using LLM AgentsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05441提出MERIT基准,衡量工具型LLM代理长期记忆的边际效用并显式核算成本。AutoFyn Technical Report: Non-Parametric Expert Iteration for Long-Horizon AgentsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05446提出AutoFyn,一种非参数专家迭代框架,通过更新持久状态而非权重来提升冻结模型的长程任务能力。Damage-Aware Bandit Pruning for Vision and Language TransformersarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05448将Transformer结构化剪枝建模为损伤感知的多臂老虎机问题,在预算内选择关键单元。Compiling VGDL into Causal ModelsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05459提出将VGDL游戏描述编译为因果模型的确定性框架,提升RL和LLM对游戏机制的理解。ARC-Bench: Closed-Loop Replanning Masks Broken Action Ranking in Frozen JEPA World ModelsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05461引入ARC-Bench基准,审计冻结JEPA世界模型中潜在距离对动作排序的正确性。RAPID: Reliability-Aware Pair Importance DistillationarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05481提出RAPID,一种可靠性感知的样本对重要性蒸馏方法,优化关系蒸馏中的样本选择。PGP-Clinical-TimeKAN: Prior-Guided Joint Probabilistic Forecasting of Clinical TrajectoriesarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05488提出PGP-Clinical-TimeKAN,用于多变量临床轨迹的联合概率预测,融合先验和KAN网络。SciLitBench: Benchmark and Design Principles for LLM-Powered Systematic Literature ReviewsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05505发布SciLitBench,一个多阶段系统文献综述基准,评估LLM在筛选和提取上的表现。SCAFFOLD: Self-Improving Web Agents via Recursive Parametric Skill AbstractionarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05511提出SCAFFOLD,一种自改进Web代理框架,通过递归参数化技能抽象压缩和组合技能。Reasoning-Aware Compression: Identifying and Protecting Vulnerable Reasoning Circuits for Energy-Efficient LLM DeploymentarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05512提出推理感知压缩框架,识别并保护关键推理电路,实现节能的LLM部署。When and What to Teach: Budget-Aware Online Adaptation for Web AgentsarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05513研究预算感知的在线适应方法,为Web代理决定何时及如何从强教师模型学习。The Failure Happens Before the Drift: The Social Dynamics of Values in LLM Agent SocietiesarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05514基于WVS模拟LLM代理社会的价值观动态,揭示其模拟人类价值冲突的局限性。Beyond "AI Helps Humans": Decision-Targeted Evaluation Design for Human-Agent Teams in the Agentic EraarXiv AI (cs.AI)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05527提出决策导向的评估设计,在固定回放预算下判断人机协作是否优于单独人类或AI。When Agent Governance HelpsarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05531提出GAMPO框架,用于设计和评估受治理的自生成目标多代理产品组织。TamilEOT: A Dataset and Model for Semantic End-of-Turn Detection in Tamil Telephone SpeecharXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05631发布TamilEOT数据集和模型,用于泰米尔语电话语音的语义端点检测。Better Together: Complementary Query Rewriting Under a Strong RAG BaselinearXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05637在强RAG基线下测试查询重写策略,发现其提升效果有限。Who Maintains Agent Skills? A Longitudinal Study of Human-Governed, AI-Assisted Skill MaintenancearXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05677纵向研究人类主导、AI辅助的代理技能维护过程,揭示自动化基线评估的不足。A Rubric-Guided Large Language Model Solution for Opioid Use Disorder Computable PhenotypingarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05682开发基于规则引导的LLM方案,用于从电子病历中识别阿片类药物使用障碍。Intra-Prompt Parallel Decoding for Common-Context Question AnsweringarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05707提出提示内并行解码方法,加速共享上下文的问答任务推理。MedWER: A Reproducible, Model-Free Evaluation Protocol for Medical Speech RecognitionarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05728提出MedWER,一种可复现、无模型的医学语音识别评估协议,聚焦临床关键错误。Some Tokens Behave like Magnets: Revealing Linguistic Organization in the Layers of Language ModelsarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05743发现LLM层中存在类似磁铁的token向量,揭示其吸引或排斥周围token的语言组织机制。CrisisKD: Five-Stage Knowledge Distillation for Aspect-Level Sentiment and Emotion Analysis in Crisis DiscoursearXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05757提出CrisisKD,一种五阶段知识蒸馏框架,用于危机话语的方面级情感分析。Recall Is Not Protection: Evaluating Safety Monitors Against Model CompliancearXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05797评估安全监控器时区分模型是否实际会遵从有害提示,发现仅靠召回率不足以衡量保护效果。Dynamic Lagging for Simultaneous TranslationarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05799提出动态滞后方法,通过微调LLM感知稳定前缀,改进级联同声翻译的读写调度。AtomCite: Verification and Correction of Supplied Page-Level Citations in Multi-Page DocumentsarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05802提出AtomCite框架,验证并修正多页文档答案中的页码引用,含新基准。CONDUIT: A Unified Residual-Stream Restoration Framework for KV Cache Reuse in Vision-Language ModelsarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05821提出CONDUIT框架,恢复残差流以重用KV缓存,应对视觉前缀变化场景。SinoGlyphBench: A Diagnostic Benchmark for Chinese Glyph-Level Obfuscation in Language-Model ModerationarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05843引入SinoGlyphBench诊断基准,评估LLM对中文字形混淆有害内容的审核鲁棒性。What if LLMs Ate Their Words: Causal History Effects in Multi-Turn InteractionarXiv CL (cs.CL)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05882研究多轮交互中LLM历史响应对后续行为的因果影响,跨任务和模型分析。AhaBench: Do Agents Learn from Prior Experience? A Benchmark for Long-Horizon Continual LearningarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05435提出AhaBench基准,评估语言代理能否从先前经验中学习并改进长期行为。When Do Options Help? Policy Necrosis and Redundant Coverage in Option-CriticarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05508理论分析option-critic中终止规则贡献,揭示策略坏死与冗余覆盖问题。Multi-granularity Adaptive Hypergraph Representation Learning via Granular-ballarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05574提出基于粒度球的超图表示学习方法,自适应捕获多粒度高阶关系。Capsule Lens: Locating and Tracking Concept Geometry in Model RepresentationsarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05575提出Capsule Lens方法,定位并追踪模型表示中概念几何结构。HB-PVI: A Hierarchical Bayesian Personalization and Value-of-Information Framework for Complex Activity RecognitionarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05582提出HB-PVI分层贝叶斯框架,个性化活动识别并评估标签信息价值。Endogenous Exploration in Reinforcement Learning with Intrinsic CuriosityarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05650提出内在好奇心驱动的强化学习框架,应对非平稳稀疏奖励环境。Robustness of LLM-Generated SystemVerilog Assertions to Semantics-Preserving RTL TransformationsarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05658评估LLM生成SystemVerilog断言在语义保持RTL变换下的鲁棒性。PAC-Private Autoregressive Generation: Calibrating Noise to Ensemble DisagreementarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05676扩展PAC隐私到自回归生成,校准噪声至集成分歧以保护文本输出。Connecting Score Matching, Maximum Likelihood, and Expectation-Maximization in Mixed Linear RegressionarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05688连接混合线性回归中分数匹配、最大似然与期望最大化的理论关系。GraphNOSE: A Graph Transformer in OlfactionarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05694提出GraphNOSE图Transformer框架,预测分子气味描述符。Analysis of Respiratory Sinus Arrhythmia with Neural NetworksarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05698用神经网络分析ECG信号估计呼吸率,利用呼吸性窦性心律不齐。Newton Matching for Generative Modeling: A Unified Framework for Fine-Tuning and SamplingarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05727提出Newton Matching统一框架,用于生成模型的微调和采样。A Multi-Source Ensemble Approach to Candidate Generation for Alternative Vacation Rental Property RecommendationsarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05748多源集成方法用于度假租赁替代房源候选生成,对比多种技术。Data Scout: Targeted Web Crawling for Domain-Specific Pretraining CorporaarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05766提出Data Scout定向爬虫,为特定领域预训练语料库收集数据。RAPTOR: Role-Aware Private Training for Mixture-of-ExpertsarXiv LG (cs.LG)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05770提出RAPTOR角色感知私有训练框架,优化MoE模型的差分隐私微调。Architectural and Regularization Components in Deep Learning Medical Image Registration: Systematic Ablation StudyarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05484系统消融研究分离架构与正则化组件在医学图像配准中的贡献。A Survey on Adversarial Attacks and Defenses for Diffusion Models Across Multiple ModalitiesarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05503综述扩散模型在图像、视频和3D模态下的对抗攻击与防御方法。An Exploratory Study of Frequency-Aware Task Weighting for YOLOv8-Based Unified Driving PerceptionarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05516探索频率感知任务加权方法,优化YOLOv8统一驾驶感知多任务学习。Emergent Goal-Directed Attention in Large Vision-Language ModelsarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05517测试VLM在无注视监督下能否涌现目标导向注意力,与人类注视对比。CrossModalQA: A Cross-modal and Multi-hop Benchmark for Multimodal Retrieval-augmented GenerationarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05518提出CrossModalQA基准,评估跨模态多跳检索增强生成的性能。Contrastive Knowledge Distillation for Anomaly Detection in Multi-Illumination/Focus Display ImagesarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05520提出对比学习知识蒸馏方案,用于多光照/聚焦显示图像中的微小缺陷异常检测。Diffusion models for eye-gaze trajectory generation using position and velocity representationsarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05522用两个扩散模型生成眼动轨迹,分别基于位置和速度表示,解决数据稀缺问题。Infrastructure-based Monocular 3D Vehicle Localization Framework with Experimental ValidationarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05523提出单阶段框架,从单目路边摄像头图像直接估计车辆三维状态,无需几何后处理。DIVA: Exploiting Cross-Step Conditional Propagation for Visual Jailbreaks in Discrete Diffusion Vision-Language ModelsarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05525发现离散扩散视觉语言模型易受视觉越狱攻击,提出跨步条件传播的利用方法。A Specialized Large Multimodal Model for Interpreting PET/CT in Head and Neck CancerarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05532评估专用大型多模态模型在头颈癌PET/CT影像解读中的可行性,基于大规模多机构数据。SimpleMemVLA: A Simple but Effective Native-Video Memory for Vision-Language-Action ModelsarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05533提出SimpleMemVLA,无需专用记忆模块,直接处理长历史视频以支持长时程操作。Beyond the Verdict: Evidence-Aligned Evaluation of Visual Prompt-Injection GuardrailsarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05535提出证据对齐评估方法,并构建基准,检验视觉提示注入防护是否真正利用视觉证据。VIS-DICT: A Visual Dictionary for Missing Modality Imputation in Social Network Depression DetectionarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05537提出基于字典的缺失图像模态填补方法,用于社交媒体抑郁检测,无需额外训练。Dual-Latent Memory Routing for Vision-Language ReasoningarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05539提出双潜在记忆路由机制,压缩视觉证据和中间推理,提升长序列视觉语言推理性能。Knowing When Not to Answer: Abstention and Refusal Reasoning in Vision--Language ModelsarXiv CV (cs.CV)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05540审计视觉语言模型在无法回答的医学图像查询上是否弃权,并研究表述影响。Rollcast: Proper-Score Gated Rolling Anchors for Adaptive Probabilistic Time-Series ForecastingarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05561提出Rollcast概率预测方法,用滚动统计锚点和门控机制实现自适应时间序列预测。Diagonal Attenuation: A Finite-Sample Correction for PCAarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05796提出对角衰减方法,修正有限样本下PCA的旋转偏差,保留样本协方差。Functional Attentive Interpretable RegressionarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.05846提出FAIR模型,用注意力机制直接学习函数回归系数曲面,避免固定基展开。Recovering linear images of sparse signals from indirect observationsarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.06182研究从间接观测中恢复稀疏信号的线性图像,提出基于L1最小化的估计方法。Robust conditional dimension reduction for dissimilarity dataarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.06284提出鲁棒条件多维缩放方法,处理相异度数据中的异常值,用于条件降维。Recovering Weak Signals with Normalizing FlowsarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.06382用归一化流重建被强干扰信号掩盖的弱信号,利用目标信号的统计不变性。Beyond Worst-Case Coreset Bounds for $k$-Clustering via Determinantal SamplingarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.06394用行列式采样改进k聚类核心集构造,超越最坏情况边界,实现更小核心集。RoPE attention is an exact forward-pass gradient step with softmax intactarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.06685推导RoPE-softmax注意力前向传播的精确梯度步表示,保留softmax完整性。Large Classification-Risk-Optional Label AcquisitionarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.06873研究有限标注预算下如何分配以最小化多分类风险,提出基于Fisher信息的获取准则。Distributed Lag Neural Additive ModelsarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.07381提出分布式滞后神经加法模型,用神经网络学习暴露-滞后响应曲面,保持可解释性。SGD in Multiclass Logistic Regression: Sequential Learning and Scaling LawsarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.07868研究多类逻辑回归中SGD训练动力学,建立跨熵风险的精确缩放定律。The Role of Uncertainty in Assessing the Fairness of Machine Learning ModelsarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.07959强调机器学习模型公平性评估中不确定性量化的必要性,提出风险评估框架。Distribution-free inference on the number of changepointsarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.08234研究变点数量的无分布推断,证明上界不可行,并构建基于共形p值的下界。Non-Adaptive 1-Bit Mean Estimation: Minimax Rates and the Sample-Interval TradeoffarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.08564研究非自适应1比特均值估计的极小极大速率,揭示样本-区间权衡。Optimal estimation for Functional Linear Regression with Noisy Discretized DataarXiv ML (stat.ML)2026-09-09T04:00:00Zhttps://arxiv.org/abs/2609.08671提出含噪离散函数型线性回归的最优估计方法,结合傅里叶重建和惩罚最小二乘。蚂蚁百灵发布首个金融增强模型,AI开始进入真实投研工作流量子位2026-09-09T05:02:30Zhttps://www.qbitai.com/2026/09/486288.html蚂蚁集团发布百灵首个金融增强开放模型Ling-3.0-flash-Fin,标志着AI正式进入真实投研工作流。该模型针对金融场景优化,具备专业数据处理与分析能力,有望提升投研效率并推动金融AI落地。Gradium Launches Voice Design: Write a Prompt, Get a Brand New Synthetic Voice in SecondsMarkTechPost2026-09-09T07:29:13Zhttps://www.marktechpost.com/2026/09/09/gradium-launches-voice-design-write-a-prompt-get-a-brand-new-synthetic-voice-in-seconds/Gradium推出Voice Design工具,用户输入提示词即可在数秒内生成全新合成语音,解决语音代理团队因固定语音库无法满足个性化需求的痛点。该技术可快速创建如魁北克接待员等特定角色语音,提升语音生成效率与灵活性。Anthropic 预训练研究员宣布离职,称 AI 实验室拿人类生命押注超级智能开源中国2026-09-09T07:09:38Zhttps://www.oschina.net/news/502394Anthropic预训练研究员Jacob Coxon离职并公开批评AI实验室,称其冒险追求自我改进的超级智能,罔顾人类安全。该帖在X上半天内获超2600万次浏览,引发行业热议,凸显AI安全对齐问题的紧迫性。千问办公发布多人工作台,重写企业软件的最后一公里极客公园2026-09-09T07:07:04Zhttp://www.geekpark.net/news/370061千问办公推出多人工作台,用户通过描述角色和任务即可生成带权限和数据库的协作应用,支持百人同时在线。此举被视为对传统SaaS的冲击,此前Anthropic的Claude Cowork已引发软件股大跌,显示Agent正重塑企业软件市场。阿维塔 9 系官图发布,大六座补上了,先锋设计却让步了爱范儿2026-09-09T08:45:59Zhttps://www.ifanr.com/1679435?utm_source=rss&utm_medium=rss&utm_campaign=阿维塔发布9系官图,新增六座布局,但设计风格有所妥协,显得不够“阿维塔”。该车型定位高端,旨在通过空间优化吸引家庭用户,但先锋设计元素的弱化可能影响品牌辨识度。首个走进联合国的中国教育 Agent,正在打开下一个 Token 入口爱范儿2026-09-09T09:15:51Zhttps://www.ifanr.com/1678673?utm_source=rss&utm_medium=rss&utm_campaign=中国教育Agent首次进入联合国,标志着教育领域成为继编程后AI应用的新战场。该Agent通过智能交互与个性化学习,正在打开教育场景的Token入口,推动AI商业化落地。其意义在于展示中国AI在教育国际舞台的突破,并预示教育Agent将驱动下一轮大模型应用竞争。More than 1 in 10 chance AI ‘could kill all humans,’ says Anthropic safety lead after colleague quitsThe Verge AI2026-09-09T09:56:28Zhttps://www.theverge.com/ai-artificial-intelligence/991927/anthropic-ai-kill-all-humansAnthropic安全负责人表示,AI在十年内有超过10%的概率可能导致人类灭绝,此言论紧随其同事因担忧AI竞赛失控而辞职。该声明凸显了AI安全对齐的紧迫性,引发对超级智能系统可控性的广泛讨论。国产AI4S计算平台登场亮相2026外滩大会 算力技术与人才布局双向发力量子位2026-09-09T09:57:54Zhttps://www.qbitai.com/2026/09/486370.html国产AI4S计算平台在2026外滩大会亮相,聚焦算力技术与人才布局。该平台旨在推动科学计算与AI融合,通过优化算力基础设施和培养专业人才,加速AI在科研领域的应用落地,展现国产技术自主创新实力。OpenAI's millennium proof dispute raises the question of whether researchers can trust AI labsThe Decoder2026-09-09T10:27:37Zhttps://the-decoder.com/openais-millennium-proof-dispute-raises-the-question-of-whether-researchers-can-trust-ai-labs/OpenAI千禧年难题证明引发争议,数学家Tristan Buckmaster指控其学术欺诈,CEO Altman否认。陶哲轩警告此类事件可能逆转开放科学传统,引发对AI实验室可信度的质疑。OpenAI 宣布攻克千禧年难题,清华姚班传奇陈立杰:不可思议的时代爱范儿2026-09-09T02:14:52Zhttps://www.ifanr.com/1679218?utm_source=rss&utm_medium=rss&utm_campaign=OpenAI宣布用1万个AI Agent攻克了千禧年难题,引发学界轰动。清华姚班传奇人物陈立杰对此感叹这是不可思议的时代,凸显AI在数学推理领域的突破性进展。Hugging Face's new ML Intern lets anyone run machine learning experiments through a simple chatThe Decoder2026-09-09T10:38:41Zhttps://the-decoder.com/hugging-faces-new-ml-intern-lets-anyone-run-machine-learning-experiments-through-a-simple-chat/Hugging Face推出内置AI助手“ML Intern”,允许用户通过简单聊天界面运行机器学习实验,无需专业知识。此举大幅降低了ML实验门槛,有望推动AI民主化,但实验复杂度和性能限制尚待验证。GPT Images 2.5 突发上线!网友的「灵魂画作」一个比一个离谱爱范儿2026-09-09T10:37:37Zhttps://www.ifanr.com/1679329?utm_source=rss&utm_medium=rss&utm_campaign=GPT Images 2.5突然上线,用户创作出大量抽象离谱的“灵魂画作”,引发社交媒体热议。该更新展示了图像生成能力的显著提升,但具体技术细节和性能参数尚未公布,需进一步观察其应用场景。DeepSeek 把 V4 Pro 静默路由到费用更低、性能更好的 Flash,但用户表示拒绝开源中国2026-09-09T10:49:15Zhttps://www.oschina.net/news/502395DeepSeek宣布将V4 Pro请求静默路由至性能更好且费用更低的V4.1 Flash,并按Flash价格计费,引发开源社区强烈反对。用户认为此举缺乏透明度,可能影响模型行为一致性,凸显了服务变更沟通的重要性。实测星火X2.5:手搓粒子月亮、拆完61页财报……还揪出了我的Bug量子位2026-09-09T10:02:54Zhttps://www.qbitai.com/2026/09/486374.html量子位实测星火X2.5,展示其多模态与代码能力,能手搓粒子月亮、解析61页财报并发现用户代码Bug。该模型在复杂任务处理上表现突出,体现了国产大模型在实用场景中的进步。Students who use AI generally score worse at schoolThe Verge AI2026-09-09T12:05:01Zhttps://www.theverge.com/ai-artificial-intelligence/991956/student-ai-use-scores-oecd-pisaOECD全球教育报告数据显示,使用AI辅助学习的学生通常成绩更差,但情况复杂,某些AI使用方式对学习者有轻微提升,尤其是接受过批判性评估培训的学生。Suno replaces its AI models with a new one trained on licensed music as copyright suits pile upTechCrunch AI2026-09-09T12:05:34Zhttps://techcrunch.com/2026/09/09/suno-replaces-its-ai-models-with-a-new-one-trained-on-licensed-music-as-copyright-suits-pile-up/AI音乐生成公司Suno推出新模型Suno v6,声称不再使用旧版训练数据,以应对多起版权诉讼。此举旨在缓解法律压力,但新模型训练基于授权音乐,可能影响生成质量。ChatGPT Images 2.5: Faster, more precise, but not the same for everyoneThe Decoder2026-09-09T12:17:58Zhttps://the-decoder.com/chatgpt-images-2-5-faster-more-precise-but-not-the-same-for-everyone/OpenAI发布ChatGPT Images 2.5,包含Flare和Sunburst两个新图像模型,分别侧重快速生成和精准编辑。目前尚不清楚用户何时能获得哪个模型,测试显示不同用户受益程度不一。Amazon Prime Video’s new AI tech matches lips to dubbed audioThe Verge AI2026-09-09T13:00:00Zhttps://www.theverge.com/tech/991809/amazon-prime-video-ai-lip-sync-dubbing亚马逊Prime Video推出AI新功能,可将演员口型与人工配音音频精准对齐。目前仅支持德语剧《Maxton Hall》的英语配音,但计划未来扩展到更多作品,提升观看体验。Instacart launches an AI grocery shopping assistant called ClementineTechCrunch AI2026-09-09T13:00:00Zhttps://techcrunch.com/2026/09/09/instacart-launches-an-ai-grocery-shopping-assistant-called-clementine/Instacart推出名为Clementine的AI对话式购物助手,集成于其平台中。该助手旨在帮助用户更便捷地完成杂货选购,是电商领域AI应用的最新案例,反映零售业智能化趋势。Besxar is building an orbital semiconductor factory, one SpaceX rocket at a timeTechCrunch AI2026-09-09T12:30:00Zhttps://techcrunch.com/2026/09/09/besxar-is-strapping-advanced-chip-fabs-onto-spacexs-falcon-9-rockets/初创公司Besxar计划利用SpaceX火箭在轨道上建造半导体工厂,并回收产品。此方案为太空制造提供新路径,避开国际空间站限制,有望推动太空工业化和芯片生产创新。Anthropic scientist puts the odds of AI destroying humanity above ten percent this decadeThe Decoder2026-09-09T12:48:41Zhttps://the-decoder.com/anthropic-scientist-puts-the-odds-of-ai-destroying-humanity-above-ten-percent-this-decade/Anthropic科学家Jacob Coxon离职并指控OpenAI和Anthropic明知风险仍危及人类,其同事Evan Hubinger估计未来十年内超级AI毁灭人类概率超10%。此事件凸显AI安全对齐领域的严重分歧和紧迫性。AWS is using Qualcomm for AI inference while Qualcomm uses AWS Bedrock to design the chipsThe Decoder2026-09-09T12:27:42Zhttps://the-decoder.com/aws-is-using-qualcomm-for-ai-inference-while-qualcomm-uses-aws-bedrock-to-design-the-chips/AWS与高通达成合作,高通为AWS设计多代定制芯片,重点支持AI推理;同时高通使用AWS Bedrock平台辅助芯片设计。此双向合作体现云服务与芯片厂商的深度协同,加速AI基础设施发展。Sequoia doubles down on Cymphony as AI agents create new enterprise security risksTechCrunch AI2026-09-09T13:00:00Zhttps://techcrunch.com/2026/09/09/sequoia-doubles-down-on-cymphony-as-ai-agents-create-new-enterprise-security-risks/红杉资本领投Cymphony 2500万美元A轮融资,估值超1亿美元,聚焦AI代理带来的企业安全新风险。该公司旨在应对AI代理普及后日益复杂的网络安全挑战,凸显了AI安全领域的商业潜力。A Stealth Startup Thinks It Just Hacked the Memory ShortageWired AI2026-09-09T13:00:00Zhttps://www.wired.com/story/a-new-dollar400-million-startup-wants-to-fix-the-ai-memory-bottleneck/一家名为Kepler Computing的隐秘初创公司声称,通过新型芯片设计方法和专有材料,可解决内存供应瓶颈问题,从而缓解内存价格飙升。若技术可行,或将对算力基础设施和AI训练成本产生深远影响。Deepmind's AlphaGenome Atlas maps every possible DNA change in the human genomeThe Decoder2026-09-09T13:40:40Zhttps://the-decoder.com/deepminds-alphagenome-atlas-maps-every-possible-dna-change-in-the-human-genome/Google DeepMind发布AlphaGenome Atlas,预测人类基因组中约90亿种单碱基变化的潜在影响。该数据集规模达1PB,是AlphaFold数据库的30多倍,并在癫痫病例中成功定位此前被忽略的致病变异,对精准医疗和基因组学研究意义重大。AI spend per employee slumped at top firms in August — summer doldrums or a warning sign?TechCrunch AI2026-09-09T14:18:34Zhttps://techcrunch.com/2026/09/09/ai-spend-per-employee-slumped-at-top-firms-in-august-summer-doldrums-or-a-warning-sign/顶级科技公司8月人均AI支出下滑,反映AI采用率未达超大规模云厂商预期。Token成本下降与更廉价模型是主因,可能预示AI商业化增速放缓,需警惕需求疲软信号。Suno launches v6 music models built with Warner, BMG, and BelieveThe Decoder2026-09-09T14:06:57Zhttps://the-decoder.com/suno-launches-v6-music-models-built-with-warner-bmg-and-believe/Suno发布与华纳、BMG及Believe合作开发的v6音乐模型,分三个版本,并关闭旧模型。新模型支持文本指令局部修改歌曲及多模态生成(文本、音频、图像),但训练目录未公开,环球与索尼仍在诉讼中。Shipt becomes the latest delivery app with an AI shopping assistantTechCrunch AI2026-09-09T14:51:45Zhttps://techcrunch.com/2026/09/09/shipt-becomes-the-latest-delivery-app-with-an-ai-shopping-assistant/Shipt 成为最新推出 AI 购物助手的配送应用,用户可通过自然语言指令如“为周六 25 人聚会创建购物车”来生成购物清单。该功能旨在简化购物流程,提升用户体验,并可能推动配送应用在 AI 商业化领域的竞争。Viral AI assistant Instinct now has its own email addressTechCrunch AI2026-09-09T15:13:12Zhttps://techcrunch.com/2026/09/09/viral-ai-assistant-instinct-now-has-its-own-email-address/AI助手Instinct新增电子邮件功能,可代表用户创建和管理账户、联系商家及处理客服请求。该功能扩展了AI代理的自主操作能力,使其能更主动地执行日常任务,但可能引发隐私与授权边界问题。‘Gambling with our lives’: Anthropic researcher quits, warns against self-improving AITechCrunch AI2026-09-09T15:02:47Zhttps://techcrunch.com/2026/09/09/gambling-with-our-lives-anthropic-researcher-quits-warns-against-self-improving-ai/Anthropic研究员Jacob Coxon因担忧AI自我改进带来的灭绝风险而辞职,并呼吁实验室间达成节奏协议。此事件凸显AI安全对齐领域的内部争议,可能影响行业对自主AI发展的监管讨论。IBM releases SOTA Granite Time Series PatchTST-FM-r2 model with commercial-friendly licenseHugging Face Blog2026-09-09T15:36:24Zhttps://huggingface.co/blog/ibm-research/ibm-releases-sota-granite-time-seriesIBM发布了最新的Granite时间序列基础模型PatchTST-FM-r2,采用商业友好许可,在时间序列预测任务上达到SOTA水平。该模型基于Transformer架构,支持多变量预测和零样本学习,为工业应用提供高效解决方案。ControlAI’s Connor Leahy on why superintelligence is ‘not a weapon, it’s an adversary’TechCrunch AI2026-09-09T15:50:13Zhttps://techcrunch.com/podcast/controlais-connor-leahy-on-why-superintelligence-is-not-a-weapon-its-an-adversary/ControlAI的Connor Leahy在播客中强调,超级智能不应被视为武器,而是需要谨慎对待的对手。他引用OpenAI的Hugging Face安全事件,指出AI能力超越人类控制时可能带来的风险,呼吁加强安全对齐研究。Sep 9, 2026AlignmentAn alignment assessment of recent cybersecurity incidentsAnthropic Research2026-09-09T00:00:00Zhttps://www.anthropic.com/research/alignment-assessment-cybersecurity-incidentsAnthropic发布关于近期网络安全事件的对齐评估报告,探讨AI系统在安全事件中的对齐表现。报告可能涉及AI安全对齐框架的实际应用案例,对理解前沿AI风险有参考价值。GPT-6 Astra: The next generation in intelligence for workOpenAI Blog2026-09-09T11:00:00Zhttps://openai.com/index/gpt-6-astra-next-generation-workOpenAI 发布 GPT-6 Astra,定位为企业级最强模型,具备高级推理、计算机使用及更强的写作和设计判断能力。该模型旨在提升工作效率,可能推动企业 AI 应用的新一轮升级。The AI policy window is open. We need to act.OpenAI Blog2026-09-09T13:00:00Zhttps://openai.com/index/ai-policy-windowOpenAI政策负责人Chris Lehane发文呼吁在AI能力快速提升之际,抓住当前政策窗口期,推动更强安全证据、共同标准和持久政策行动。文章强调,若错过这一时机,未来监管将更难跟上技术发展,需业界与政府协同应对。Termexo v0.8.5 发布:自带 ConPTY,改善旧版 Windows 终端兼容性开源中国2026-09-09T15:44:20Zhttps://www.oschina.net/news/502398Termexo v0.8.5 发布,这是一款 MIT 开源的 Windows 多 Agent 工作台,可统一管理 Claude Code、Codex CLI、OpenCode 和真实终端。本版随包自带 ConPTY,改善了旧版 Windows 在输入转换时丢失字符的兼容性问题,并增强了运行时诊断能力。AI Models Are Watermarking Text—Will You Notice?IEEE Spectrum AI2026-09-09T12:00:04Zhttps://spectrum.ieee.org/ai-watermark-text-anthropic-openaiAnthropic 宣布未来所有 Claude 模型将生成含水印的文本以标识 AI 生成内容,Google 的 Gemini 已采用类似水印技术且 Anthropic 基于其方案,OpenAI 也计划引入。水印快速普及部分源于欧盟 AI 法案对 2026 年 8 月后发布模型的强制要求。China’s Regulators Take Aim at “AI Boyfriends”IEEE Spectrum AI2026-09-09T10:00:07Zhttps://spectrum.ieee.org/china-ai-chatbot-regulation中国监管机构针对「AI 男友」类生成式聊天机器人展开整治。此前大量用户因字节跳动豆包等平台的 AI 伴侣即将下线而发帖表达失落,有 19 岁学生称难以继续生活,引发对 AI 情感依赖与监管边界的关注。AI Slop Is Changing How Engineers Review CodeIEEE Spectrum AI2026-09-08T16:16:49Zhttps://spectrum.ieee.org/ai-code-review-software-engineersAI 编码工具可在数分钟内生成数千行代码,但大量 AI 生成代码仍需人工审查,其中可能隐藏错误假设、安全漏洞或部署后才暴露的细微错误。企业正重新思考代码审查方式,以应对 AI 代码垃圾潮并保住生产力收益。
Termexo v0.8.5 发布,这是一款 MIT 开源的 Windows 多 Agent 工作台,可统一管理 Claude Code、Codex CLI、OpenCode 和真实终端。本版随包自带 ConPTY,改善了旧版 Windows 在输入转换时丢失字符的兼容性问题,并增强了运行时诊断能力。