infoAI 日报 2026-09-082026年09月08日12195论文 60 / 官方 9 / 英文媒体 19 / 中文媒体 33本页聚合 AI 前沿信息:arXiv 论文、OpenAI/DeepMind/Meta/HuggingFace 官方博客、国内外 AI 媒体,均为最近 7 天内发布,附中文摘要与重要度评级。I made a free AI chatbot solve a decade-long maths problem in 13 minutesNew Scientist AI2026-09-07T16:09:29Zhttps://www.newscientist.com/article/2587148-i-made-a-free-ai-chatbot-solve-a-decade-long-maths-problem-in-13-minutes/?utm_campaign=RSS|NSNS&utm_content=artificial-intelligence&utm_medium=RSS&utm_source=NSNS一位记者测试免费AI聊天机器人,发现其在13分钟内解决了一个困扰十年的数学难题,速度令人震惊。该测试凸显了AI在数学推理领域的快速进步,可能对科研和问题求解产生深远影响。ChatGPT claws back web traffic share to 55.5 percent as Gemini's brief comeback fadesThe Decoder2026-09-07T16:54:12Zhttps://the-decoder.com/chatgpt-claws-back-web-traffic-share-to-55-5-percent-as-geminis-brief-comeback-fades/ChatGPT网站流量份额回升至55.5%,但同比从73.3%大幅下滑,因Gemini份额翻倍、Claude增长近五倍。移动应用和桌面客户端未计入统计,显示竞争加剧。AI-designed drug appears to turn back the body's biological clock in early trialThe Decoder2026-09-07T16:34:20Zhttps://the-decoder.com/ai-designed-drug-appears-to-turn-back-the-bodys-biological-clock-in-early-trial/AI设计药物rentosertib在早期试验中显示可逆转生物衰老标志,六个独立衰老时钟预测治疗组生物年龄比安慰剂组年轻最多六岁。试验仅42人,且未在健康人中测试,需谨慎解读。GPT-6 Astra beat Portal start to finish without human help in under 24 hoursThe Decoder2026-09-07T17:39:32Zhttps://the-decoder.com/gpt-6-astra-beat-portal-start-to-finish-without-human-help-in-under-24-hours/GPT-6 Astra在无人类干预下,约24小时内自主通关解谜游戏《传送门》,开发者已开源代码。该事件展示了大模型在复杂任务中的自主规划与执行能力,但开发者提醒这可能是未来最差模型,暗示技术迭代速度惊人。Anthropic reportedly signs $517 billion in compute deals after Dario Amodei warned rivals about reckless riskThe Decoder2026-09-07T18:12:41Zhttps://the-decoder.com/anthropic-reportedly-signs-517-billion-in-compute-deals-after-dario-amodei-warned-rivals-about-reckless-risk/Anthropic签署了高达5170亿美元的算力合同,但仍落后于OpenAI到2030年7500亿美元的计划。CEO Dario Amodei曾警告过快投资风险,如今公司正加速追赶,而Sam Altman则批评算力建设中的“不可持续的愚蠢行为”,尤其针对新兴云服务商。Axis Robotics Releases AXIS: A Browser-Based Data Engine With 207 Robot Manipulation Tasks and 50,129 TrajectoriesMarkTechPost2026-09-07T18:38:47Zhttps://www.marktechpost.com/2026/09/07/axis-robotics-releases-axis-a-browser-based-data-engine-with-207-robot-manipulation-tasks-and-50129-trajectories/Axis Robotics发布AXIS,一个基于浏览器的机器人数据引擎,包含207个操作任务和50,129条Franka轨迹。它通过将演示采集移至浏览器并利用后端GPU,解决了机器人数据集增长缓慢的问题。AXIS的持续预训练将π0.5在LIBERO-Plus上的准确率从83.9提升至88.8,远超体积匹配的RoboCasa365对照组的57.5,展示了高效数据生成对机器人模型性能的显著提升。Opaque recurrence, and other AI terms that you should probably knowTechCrunch AI2026-09-07T19:24:00Zhttps://techcrunch.com/2026/09/07/artificial-intelligence-definition-glossary-hallucinations-guide-to-common-ai-terms/AI 的兴起带来了大量新术语和俚语,本文提供了一份重要词汇表,帮助读者理解这些术语的定义。涵盖从技术概念到行业黑话的常见表达,适合快速入门。OpenBMB Releases MiniCPM5-2B: A 2.52B Dense Model Averaging 53.9 Across 34 Benchmarks and Built to Run On DeviceMarkTechPost2026-09-07T19:18:07Zhttps://www.marktechpost.com/2026/09/07/openbmb-releases-minicpm5-2b-a-2-52b-dense-model-averaging-53-9-across-34-benchmarks-and-built-to-run-on-device/OpenBMB 发布 MiniCPM5-2B,一个 25.2 亿参数的稠密模型,平均分 53.9 超过 Qwen3.5-4B,支持 13 万 token 上下文。通过深度思考 SFT 和 RL 训练,融合 16 个专家模型,Apache 2.0 开源全部权重和数据。早报|华为Mate XT 2首发「韬定律」麒麟芯片/20.99万起,小米澎程上市/「豆包手机」定档下周三爱范儿2026-09-08T00:14:12Zhttps://www.ifanr.com/1676969?utm_source=rss&utm_medium=rss&utm_campaign=本批早报涵盖华为、小米、字节跳动等科技动态,涉及折叠屏手机、AI手机及融资消息。华为Mate XT 2首发麒麟芯片,小米澎程上市,字节跳动获巨额贷款,全球折叠屏手机出货量预计年内破亿。传字节开发实时空间视频生成模型,张一鸣亲自督导;微信内测「AI 社交」功能;华为小米同天发布折叠屏手机极客公园2026-09-08T00:34:54Zhttp://www.geekpark.net/news/369965字节跳动正开发实时空间视频生成AI模型,由张一鸣亲自督导,最快下月发布。该模型基于Seedance,旨在生成交互式三维虚拟世界,支持直播、短剧和游戏,并与Pico硬件深度协同。其核心是将计算移至云端,降低VR设备成本,可能重塑行业竞争格局。手机影像的下半场,是成就作品爱范儿2026-09-08T02:00:22Zhttps://www.ifanr.com/1679038?utm_source=rss&utm_medium=rss&utm_campaign=vivo X500系列即将于9月21日亮相,核心目标是打破手机影像的现有桎梏,强调成就作品而非单纯参数提升。文章探讨手机影像下半场的发展方向。敢卖一万元的小米手机,底气在哪里|小米 18 Fold 评测爱范儿2026-09-08T02:00:07Zhttps://www.ifanr.com/1678982?utm_source=rss&utm_medium=rss&utm_campaign=小米18 Fold折叠屏手机售价达万元,评测指出其自研玄戒芯片表现良好,但并非唯一支撑点。文章分析小米高端化策略的底气来源与产品综合竞争力。openKylin社区2026年8月运营报告开源中国2026-09-08T02:22:43Zhttps://www.oschina.net/news/502372openKylin社区发布2026年8月运营报告,新增广州视睿电子为白银捐赠人,并召开技术委员会会议。会议汇聚麒麟软件、联想开天、海光信息等多家单位,讨论社区治理与技术发展。图表脚本语言 D2 正式开源自动布局引擎 TALA开源中国2026-09-08T02:21:10Zhttps://www.oschina.net/news/502371/d2lang-tala-is-open-source图表脚本语言D2正式开源其自动布局引擎TALA,采用MPL-2.0许可证,源码托管于GitHub。TALA专为软件架构图设计,与Dagre、ELK不同,采用正交布局,更接近白板手绘风格。DataBuff v0.1.9 发布 · SkyWalking 8.x 接入 + LLM 凭据加固开源中国2026-09-08T02:20:22Zhttps://www.oschina.net/news/502370DataBuff发布v0.1.9版本,新增SkyWalking 8.x接入和LLM凭据加固功能。该工具是面向云原生与微服务的AI Native OpenTelemetry APM,采用OTLP标准和Apache Doris存储,支持多Agent排障。AgentOS上新!基于openKylin 3.0 的全面进化开源中国2026-09-08T02:14:36Zhttps://www.oschina.net/news/502369openKylin 3.0 AgentOS推送新一轮更新,重点提升智能体任务完成可靠性,修复系统智能体、CUA桌面操作智能体等数十项缺陷。新增语音交互和人机智能协同功能,覆盖任务管理场景。ip2region 3.18.0 发布 - 数据更新 & C++ windows 支持开源中国2026-09-08T01:56:41Zhttps://www.oschina.net/news/502368ip2region 3.18.0发布,更新数据并支持C++ Windows平台。该库是离线IP数据管理框架,支持IPv4/IPv6和亿级IP段管理,查询性能达10微秒级,官方社区同步上线强化工具链。轻量级运维极速引擎 OpsFlash v0.5.0 正式发布开源中国2026-09-08T01:26:12Zhttps://www.oschina.net/news/502367轻量级运维引擎OpsFlash发布v0.5.0,新增指令编排功能,支持从命令库/脚本库组合任务批量执行,步骤可排序混排。提供遇错停止或忽略错误两种失败策略,并增强执行观测能力。王云鹤创业后交出首个模型量子位2026-09-08T02:14:47Zhttps://www.qbitai.com/2026/09/485555.html王云鹤创业后发布首个模型,将多模型执行经验应用于模型训练,标志着其创业项目取得初步成果。该模型可能融合了多模型协作或执行优化技术,具体细节待披露。开源媒体服务器 Jellyfin 12.0 正式发布,版本号终于对齐了开源中国2026-09-08T02:32:41Zhttps://www.oschina.net/news/502373/jellyfin-release-12-0开源媒体服务器Jellyfin发布12.0版本,将版本号从10.x对齐为12.0,结束了长达八年的10.x时代。此次更新重点在于数据库重构和新增书籍/漫画支持,并计划今后主版本每年更新一次。Reducto Releases r-1: A Single Pass Document Parsing Model That Cuts Errors 20% at 1 Cent Per PageMarkTechPost2026-09-08T03:07:15Zhttps://www.marktechpost.com/2026/09/07/reducto-releases-r-1-a-single-pass-document-parsing-model-that-cuts-errors-20-at-1-cent-per-page/Reducto 发布 r-1 文档解析模型,单次扫描完成 OCR、布局检测等任务,错误率降低 20%,每页成本仅 1 美分。相比传统多阶段流程,成本从 3-6 美分大幅下降,性能显著提升。深入马来西亚AI现场!WAIC CONNECT MALAYSIA首日亮点全速递量子位2026-09-08T02:42:24Zhttps://www.qbitai.com/2026/09/485630.htmlWAIC CONNECT MALAYSIA 首日活动在马来西亚举办,聚焦 AI 市场与场景应用。活动旨在促进国际交流与合作,展示当地 AI 发展机遇。AI 开始「互发微信」了,谁来管管它们?| AI 器物志爱范儿2026-09-08T03:06:24Zhttps://www.ifanr.com/1679104?utm_source=rss&utm_medium=rss&utm_campaign=AI 开始互发微信,引发监管讨论。文章探讨了 AI 自主通信带来的伦理与法律问题,强调需要建立相应规范。深度智控获宁德时代、沙特阿美战投等重磅加码,加速打造物理AI时代算力与能源底座量子位2026-09-08T03:22:17Zhttps://www.qbitai.com/2026/09/485784.html物理AI企业深度智控完成B+轮数亿元融资,获宁德时代、沙特阿美战投等加码,资金将用于加速打造物理AI时代的算力与能源底座。此轮融资凸显产业资本对AI基础设施领域的战略布局,或推动能源与算力融合创新。现场围观金融AI决赛,大厂挑人的逻辑我悟了量子位2026-09-08T05:05:03Zhttps://www.qbitai.com/2026/09/485794.html文章报道金融AI竞赛决赛现场,揭示大厂选拔人才的标准和逻辑,涉及百万奖金、大厂直通和VC跟投等激励。通过现场观察,作者总结了金融AI领域对人才技能和实战能力的要求,为从业者提供参考。qModel开源版算法模型平台v1.4.2上线版本管理与对比功能,让模型每一次迭代都有迹可循开源中国2026-09-08T05:51:47Zhttps://www.oschina.net/news/502378qModel开源版算法模型平台v1.4.2新增模型版本管理与版本对比功能,支持快速创建新版本、横向对比、多版本并存与回滚,完善模型迭代到治理的管理链路。该更新旨在解决模型文件复制混乱问题,建立清晰的版本演进关系。qKnow 专业版 v3.1.3 发布:抽取任务消息提醒新增,多维度细节优化升级知识治理体验开源中国2026-09-08T05:49:57Zhttps://www.oschina.net/news/502377qKnow智能体构建平台专业版v3.1.3发布,优化知识治理体验,新增结构化与非结构化抽取任务的消息提醒、文件预览kkFileView部署配置及首页提醒显示控制。这些改进旨在减少任务执行和平台配置中的重复操作,提升用户效率。qData 开源版数据中台 v1.6.2 发布:修复多项已知问题,提升平台稳定性与使用体验新版发布开源中国2026-09-08T05:48:16Zhttps://www.oschina.net/news/502376qData数据中台开源版v1.6.2发布,主要修复系统稳定性、数据连接校验、元数据管理及项目管理等问题,完善异常处理和前后端校验逻辑。该版本聚焦于提升平台运行细节和操作反馈一致性,增强企业数据平台的使用体验。Termexo V0.8.2 发布:改善多终端输入卡顿,新增 1M 上下文与推理强度配置开源中国2026-09-08T05:11:38Zhttps://www.oschina.net/news/502375Termexo V0.8.2发布,这是MIT开源的Windows多Agent工作台,统一管理Claude Code、Codex CLI等工具。本次更新改善多终端持续输出时的输入卡顿与启动恢复,并新增1M上下文和推理强度配置选项,提升多Agent协作体验。感谢用GPT-6搓3D的!燃烧自己的token换来一次全体重置量子位2026-09-08T06:05:30Zhttps://www.qbitai.com/2026/09/485854.html报道称用户利用GPT-6生成3D内容,无需学习Blender等专业软件,通过消耗token即可实现建模。此举引发社区热议,被视为AI降低创作门槛的又一例证,可能重塑3D设计流程。RT-Thread专家解读:讲清AI工业质检落地最后一公里开源中国2026-09-08T06:49:56Zhttps://www.oschina.net/news/502381本文探讨AI工业质检落地的挑战,指出其核心卡点不在模型本身,而在于工厂现场数据采集、缺陷样本标注等定制化环节。每种工件和工艺需重新训练,过程繁琐,是落地“最后一公里”的关键瓶颈。Xiaomi MiMo 桌面客户端开放邀测,能做 3D 游戏和完整 PPT开源中国2026-09-08T07:13:19Zhttps://www.oschina.net/news/502382/xiaomi-mimo-desktopXiaomi MiMo 桌面客户端开放邀测,定位从“回答问题”转向“交付成果”,支持多格式素材输入、任务拆解和工具调用,可生成 3D 游戏和完整 PPT。该应用面向真实工作场景,强调高可用度输出,推动桌面 AI 应用向实用化演进。IFA 2026 现场:下一代穿戴设备的本质,是把录音笔和摄像头戴在身上极客公园2026-09-08T07:29:19Zhttp://www.geekpark.net/news/370007IFA 2026 展会上,穿戴设备趋势从屏幕转向无屏化,核心是将录音、摄像头等采集功能集成到设备中。小米手环 11 提升亮度至 2000 尼特,而 Plaud、Circular 等品牌推出无屏戒指和录音手环,强调轻量化和功能替代,吸引全球代理商关注。单人一月烧掉 19 万,硅谷开始倒查员工 AI 账单极客公园2026-09-08T07:27:11Zhttp://www.geekpark.net/news/370006微软员工自发表格中新增“每月 AI 花费”列,最高个人 28 天烧掉 2.8 万美元,引发公司收紧 token 用量管理。微软实施部门预算、个人支出仪表盘,并切换默认模型至 GPT-5.6 Sol,标志着 AI 成本控制成为企业关注焦点。Mistral AI raises 3 billion euros in Europe's largest-ever tech funding round despite lagging behind rivalsThe Decoder2026-09-08T07:45:41Zhttps://the-decoder.com/mistral-ai-raises-3-billion-euros-in-europes-largest-ever-tech-funding-round-despite-lagging-behind-rivals/Mistral AI 完成 30 亿欧元 D 轮融资,估值突破 210 亿欧元,创欧洲科技融资纪录,尽管其技术实力仍落后于美国头部对手。此轮融资凸显欧洲对本土 AI 冠军企业的资本支持力度,但市场对其商业化前景和竞争压力存在疑虑。OrcaTerm 发布新版:加入命令预测、AI 纠错与任务状态通知开源中国2026-09-08T06:43:36Zhttps://www.oschina.net/news/502379OrcaTerm 新版将 AI 深度融入终端操作,新增命令预测、终端内对话、AI 纠错及 Agent 状态通知功能,并优化了大规模输出场景下的渲染性能。该智能终端面向开发者和云服务器管理,提供 Web、桌面客户端和微信小程序三种入口,支持本地终端、SSH 连接及多人协作等场景。小米澎程 20.99 万元起!五座七座双车齐发,「探索版」还分上下铺爱范儿2026-09-08T08:03:47Zhttps://www.ifanr.com/1679179?utm_source=rss&utm_medium=rss&utm_campaign=小米发布澎程系列家庭SUV,起售价20.99万元,提供五座和七座版本,并推出带上下铺设计的探索版,主打空间创新。该车型旨在满足家庭用户对灵活空间的需求,探索版设计独特,可能吸引多孩家庭或户外爱好者。deepin 25.2.2 正式版更新!开源中国2026-09-08T06:47:10Zhttps://www.oschina.net/news/502380deepin 25.2.2正式版发布,重点增强Treeland桌面体验,新增窗口二分屏、支持pointer-constraints和relative-pointer协议,改善游戏及3D应用鼠标交互,并引入液态玻璃效果,优化Electron应用在Wayland下的兼容性。底层技术持续升级,提升视觉和性能表现。DeepSeek V4.1 Flash 中间版本开启内测开源中国2026-09-08T08:54:08Zhttps://www.oschina.net/news/502383DeepSeek 于9月8日推出V4.1 Flash中间测试版,仅供开发者内测两天,模型将于9月10日自动下线。此举旨在提前收集反馈,而非正式发布,凸显其快速迭代策略。开源不止代码,2026北京开源创新赛AIGC赛道全民可参与开源中国2026-09-08T09:56:56Zhttps://www.oschina.net/news/5023842026北京开源创新赛新增AIGC赛道,强调开源内涵从代码扩展到AI协作方法论。赛事鼓励全民参与,分享提示词调试、工作流打磨等与AI协作的实践,体现开源精神在AI时代的延伸。就在明天!苹果折叠掀起史上最强新机发布潮爱范儿2026-09-08T10:30:59Zhttps://www.ifanr.com/1679021?utm_source=rss&utm_medium=rss&utm_campaign=苹果即将发布折叠屏新机,引发科技界高度关注,被视为史上最强新机发布潮的开端。该事件可能推动折叠屏技术普及,并带动行业竞争升级。This AI entrepreneur is developing agents that can plan ahead for the unexpectedMIT Tech Review AI2026-09-08T10:34:00Zhttps://www.technologyreview.com/2026/09/08/1142088/danijar-hafner-developing-plan-ahead-agents/报道了AI创业者Danijar Hafner的隐身初创公司,专注于开发能预判意外情况的规划型Agent。公司虽处早期阶段,但技术方向强调前瞻性规划,可能对Agent在动态环境中的可靠性有重要影响。The Work Now Within ReachOpenAI Blog2026-09-08T13:00:00Zhttps://openai.com/index/the-work-now-within-reachOpenAI 博客探讨了更强且更经济的 AI 如何扩展个人和企业的可完成工作范围,并推动经济增长。文章强调 AI 能力提升与成本下降将带来更广泛的实用性和效率提升。Adobe is trying to make its AI generators idiot-proof in PremiereThe Verge AI2026-09-08T13:00:00Zhttps://www.theverge.com/tech/991133/adobe-is-trying-to-make-its-ai-generators-idiot-proof-in-premiereAdobe 在 Premiere 中推出 Generative Media 工具,简化 AI 生成视频、音效和音乐的操作,无需离开时间线。此举旨在降低专业编辑门槛,提升工作流程集成度。实测全球上线的 vivago R1,我用它打造了一部赛博西游记短片爱范儿2026-09-08T13:40:34Zhttps://www.ifanr.com/1678636?utm_source=rss&utm_medium=rss&utm_campaign=爱范儿实测全球上线的vivago R1视频生成模型,并利用其制作了一部赛博西游记短片,展示了该工具在创意内容生产中的实用性。文章强调,随着此类工具普及,普通用户也能轻松创作高质量AI视频,标志着AI视频创作进入大众化阶段。OpenAI expands initiatives to support journalism from classrooms to newsroomsOpenAI Blog2026-09-08T00:00:00Zhttps://openai.com/index/supporting-journalism-from-classrooms-to-newsroomsOpenAI扩展对新闻业的支持,为学生、教育者、记者和新闻机构提供工具、培训和合作机会。此举旨在促进AI在新闻领域的负责任应用,增强内容生产与传播效率。Safety for Whom? Refusing the Right Subset of a Topic, Not the Whole TopicHugging Face Blog2026-09-08T14:23:07Zhttps://huggingface.co/blog/MultiverseComputingCAI/safety-for-whom该研究提出在安全对齐中应拒绝话题的特定子集而非整个话题,以提升模型安全性与实用性。通过精细控制拒绝范围,避免过度限制,平衡安全与功能。AlphaGenome Atlas: A predictive map of every possible DNA letter change in the human genomeGoogle DeepMind Blog2026-09-08T14:00:15Zhttps://deepmind.google/blog/alphagenome-atlas-a-predictive-map-of-every-possible-dna-letter-change-in-the-human-genome/Google DeepMind发布AlphaGenome Atlas,绘制人类基因组中90亿个单字母DNA变异的分子效应预测图。该工具旨在加速生物学研究,为疾病治疗提供新方向,是基因组学AI应用的重大突破。Google’s Atlas of the human genome could pave the way for new treatmentsThe Verge AI2026-09-08T14:00:00Zhttps://www.theverge.com/ai-artificial-intelligence/991180/google-launches-alpha-genome-atlasGoogle DeepMind的AlphaGenome Atlas被宣称能帮助解开人类基因组之谜,加速科学研究和疾病治疗开发。该平台提供全基因组变异预测,有望变革生物学理解,推动医学进步。Mistral raises €3B as sovereign AI becomes big businessTechCrunch AI2026-09-08T14:17:48Zhttps://techcrunch.com/2026/09/08/mistral-raises-e3b-as-sovereign-ai-becomes-big-business/法国AI实验室Mistral完成30亿欧元D轮融资,估值达210亿欧元,由三星、Scaleup Europe和PSG Equity领投。此轮融资凸显“主权AI”成为商业热点,欧洲正加速构建本土AI生态。Meta drops AI usage from engineer performance reviews after "tokenmaxxing" backfiresThe Decoder2026-09-08T14:27:40Zhttps://the-decoder.com/meta-drops-ai-usage-from-engineer-performance-reviews-after-tokenmaxxing-backfires/Meta因“tokenmaxxing”滥用现象,决定不再将AI工具使用量作为工程师绩效评估标准。此举旨在纠正激励偏差,强调工作质量而非AI使用频率,反映企业AI落地中的管理挑战。Patagonia has what AI data centers want, including no resistance so farThe Decoder2026-09-08T15:16:47Zhttps://the-decoder.com/patagonia-has-what-ai-data-centers-want-including-no-resistance-so-far/巴塔哥尼亚地区因具备建设大型AI数据中心的有利条件而受到关注,目前尚未遇到明显阻力。该地区可能成为未来AI基础设施的重要选址,但其长期影响和可持续性仍需观察。ASML locks in TSMC, Samsung, and Intel while Huawei races to break its gripThe Decoder2026-09-08T15:11:59Zhttps://the-decoder.com/asml-locks-in-tsmc-samsung-and-intel-while-huawei-races-to-break-its-grip/ASML成功说服台积电、三星和英特尔采用更大光罩,使其最新EUV光刻机吞吐量提升40%。与此同时,华为正通过设备商玉良升及本土供应链推动中国摆脱对荷兰光刻技术的依赖,凸显全球半导体竞争加剧。Funding grants for new research into AI and teen developmentOpenAI Blog2026-09-08T09:00:00Zhttps://openai.com/index/teen-development-research-grantsOpenAI 推出 500 万美元资助计划,支持关于生成式 AI 对青少年发展、福祉和安全影响的独立研究。该计划旨在填补该领域的研究空白,并邀请相关研究者申请。Chrome is now shipping updates every 2 weeks as AI changes the security landscapeTechCrunch AI2026-09-08T15:04:09Zhttps://techcrunch.com/2026/09/08/chrome-is-now-shipping-updates-every-2-weeks-as-ai-changes-the-security-landscape/谷歌将Chrome更新周期缩短至每两周一次,以应对AI带来的安全挑战并加速功能迭代。此举旨在更快修复漏洞并适应快速变化的威胁环境。On the Navier–Stokes Millennium Prize ProblemOpenAI Blog2026-09-08T10:00:00Zhttps://openai.com/index/navier-stokes-solutionOpenAI发布了一份AI生成的Navier-Stokes千禧年大奖问题解决方案,包含论文和Lean形式化证明。该尝试展示了AI在数学推理与形式验证方面的潜力,但尚未经同行评审确认其正确性。Introducing ChatGPT Images 2.5OpenAI Blog2026-09-08T11:30:00Zhttps://openai.com/index/introducing-chatgpt-images-2-5OpenAI发布ChatGPT Images 2.5,可将想法、草图及参考照片转化为更个性化、精致的图像。该版本显著提升图像生成质量与用户意图匹配度,强化了多模态创作能力,对设计师和普通用户均具实用价值。1Password increases engineering productivity 21% with CodexOpenAI Blog2026-09-08T00:00:00Zhttps://openai.com/index/1password1Password 使用 OpenAI 的 Codex 工具,将工程生产力提升了 21%。工程师利用 Codex 快速构建新功能和内部工具,同时保持严格的安全策略,达到生产就绪状态。TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action ModelarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09158v1提出TANGO,首个全身视觉语言导航框架,实现人形机器人在杂乱环境中按语言指令行动。Procedural Graphs: Self-Evolving Execution Structures for LLM AgentsarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09153v1提出过程图,为LLM智能体构建自演化执行结构,提升长程任务规划与工具调用顺序性。NOAH: Learning the Full Patient Journey. A Longitudinal Multimodal Time-Aware Model for Representation and ForecastingarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09140v1提出NOAH,一种纵向多模态时间感知模型,用于患者全病程表征与预测。A Data-Driven Framework for Identifying and Prioritizing RPA Opportunities in Healthcare ProcessesarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09137v1提出数据驱动框架,系统识别和优先排序医院流程中的RPA自动化机会。Co-Evolving Harnesses and Models: On-Policy Correction Helps Weaker Models Catch Up Where Imitation FailsarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09134v1研究智能体框架与模型协同演化,发现在线策略校正可助弱模型超越模仿学习。ExecCritic: Learn to Test, Test to Improve for Coding AgentsarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09133v1提出ExecCritic框架,通过测试-验证-修订流程和角色强化学习提升编码智能体修复能力。A Generalization of Amari's Bayesian DualityarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09126v1推广Amari贝叶斯对偶性,连接凸对偶并探讨其对现代AI的启示。Canonical Color as a Lens into Concept Decodability in Vision Encoders and VLMsarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09124v1用规范颜色作为探针,研究视觉编码器与VLM中概念可解码性。DeCAL: Towards Physically-Grounded Dexterous Vision-Language-Action Models via Contact-Aware Latent Co-ImaginationarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09119v1提出DeCAL,基于接触感知的灵巧操作视觉语言动作模型,融合触觉与物理建模。MeClear: Cooperative Game-Theoretic Attribution and Risk-Aware Memory Clearance for Long-Horizon LLM AgentsarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09115v1提出MeClear,基于博弈论归因与风险感知的长程LLM智能体记忆清理框架。SAEScientist-Bench: Can AI Agents Conduct Autonomous SAE Interpretability Research?arXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09113v1引入SAEScientist-Bench,评估AI智能体能否自主进行SAE可解释性研究。The Surprising Effectiveness of Approximate Value Iteration in Self-PlayarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09094v1发现近似值迭代在自对弈游戏中效果惊人,可替代MCTS且计算开销更低。Measuring LLM Sycophancy under Sustained Multi-Turn PressurearXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09090v1提出SPINE基准,测量LLM在持续多轮压力下的谄媚行为。GoDeep: Annotation-Free Open-Vocabulary 3D Scene Understanding via Language-Space LiftingarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09082v1提出GoDeep,无需标注和3D训练语料,通过语言空间提升实现开放词汇3D场景理解。Everything in Moderation: Per-Domain Coverage Optima and Alignment-Resistant Domain Gaps in Multi-Domain Mid-TrainingarXiv AI (cs.AI)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09081v1研究多领域中期训练中数据覆盖最优与对齐难以消除的领域差距。Learning Length-Extrapolatable Recurrent ModelsarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09157v1提出可长度外推的循环模型训练方法,通过干预状态信用解决BPTT失效。ReCite: Agentic Reasoning for Faithful CitationarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09156v1提出ReCite,基于智能体推理的忠实引用生成方法,解决错误归因问题。Copying explains the collective behavior of AI agents in the wildarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09150v1分析真实世界中AI智能体集体行为,发现复制是其主要协作机制。Studying Image Tokenizers as Visual Languages in Unified Multimodal ModelsarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09143v1研究图像分词器作为统一多模态模型视觉语言的行为与学习特性。Entropy-Regularized Rank-Masked Policy Optimization for Test-Time Reinforcement Learning in Code GenerationarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09135v1提出探针驱动的测试时强化学习,用行为共识奖励提升代码生成性能。It's Not RoPE that Creates Sinks: The Role of Self-Concentration and Value-Non-Mixing in AttentionarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09085v1揭示注意力汇聚与值非混合是注意力汇和巨激活的成因,而非RoPE。ActReview: Rebuttal-Guided Training Data and Rubric Rewards for Actionable Peer Review GenerationarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09076v1提出ActReview,基于反驳引导的训练数据和评分奖励生成可操作同行评审。ToolLoop: Closed-Loop Tool-Use Data Synthesis via Decomposed Generation and Dynamic Self-FeedbackarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09072v1提出ToolLoop,闭环工具使用数据合成框架,通过分解生成和动态自反馈提升数据质量。Performance of Clinical AI System and Physicians and Frontier Language Models in primary care diagnosticsarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09070v1比较临床AI系统、医生和前沿语言模型在初级保健诊断中的性能。The Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision AuditsarXiv CL (cs.CL)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09048v1研究发现审计方式对LLM人口统计偏见检测的影响不显著,与先前结论相反。Silver Rate Is (Almost) Optimal for Gradient Descent AccelerationarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09152v1证明银步长在梯度下降加速中近乎最优,给出非任意和任意时间下界。Nearly Tight Rademacher Bounds for Sparsely Activated Neural NetworksarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09130v1为稀疏激活神经网络提供紧密Rademacher复杂度界,消除维度因子。When Does Scale-Invariant Optimization Become Unstable? An Exact Schedule Law with Weight DecayarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09116v1揭示尺度不变优化中学习率与权重衰减的精确离散时间交互律,界定稳定性边界。Curriculum Learning as Transport: Understanding Curricula with Wasserstein GeodesicsarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09099v1用Wasserstein测地线统一课程学习设计因素,提供解耦分析框架。ThinkPrior: Zero-Rollout Difficulty Priors for Cold-Start Prompt Selection in RLVRarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09075v1提出ThinkPrior,用零回滚难度先验解决RLVR中提示选择的冷启动问题。Multi-Task Learning for Sparsely-Labeled Time Series: A Case Study on Cold-Hardiness ModelingarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09062v1多任务学习用于稀疏标签时间序列预测,案例为葡萄抗寒性建模。PlayTrain: An Efficient Reinforcement Learning Framework for LLM-Generated Adaptable JavaScript GamesarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09059v1PlayTrain框架用LLM生成JavaScript游戏并高效运行于RL环境。Training-Free Task Vectors for LLM Behavioral ControlarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09054v1提出免训练任务向量,无需微调即可实现LLM行为控制。Do Reasoning Representations Help Humans Evaluate LLM Outputs?arXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09038v1研究推理表示作为人类评估LLM输出的界面,进行受控用户研究。Answer-Distribution Trajectories: A Stochastic-Dynamics View of LLM ReasoningarXiv LG (cs.LG)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09030v1提出答案分布轨迹,以随机动力学视角追踪LLM推理过程。SyncWorld: Visual Calibration Enables World Models as Zero-Shot SimulatorsarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09155v1SyncWorld通过视觉校准使世界模型成为零样本模拟器。Point4D: Long-range 4D Motion ReconstructionarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09145v1Point4D实现长视频序列的4D运动重建,支持数百帧轨迹预测。Mask Forcing: Improving Autoregressive Video Diffusion Distillation via Dual-Noise Masking RolloutarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09123v1Mask Forcing通过双噪声掩码改进自回归视频扩散蒸馏质量。Rethinking Learned Occupancy in Autonomous Active Mapping with Observation-Gated FilteringarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09069v1重新思考主动建图中学习占用预测,提出观测门控过滤方法。"World Knowledge" in the Weights: Reading Concept Circuits of Vision TransformersarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09055v1用跨层转码器读取ViT概念电路,揭示世界知识内部结构。Task-driven Processing with Coarse-to-Fine Glimpse-based Active PerceptionarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09025v1CF-GAP实现任务驱动的粗到细主动感知,选择性聚焦图像区域。PIC: Revisiting INR for Image Coding with Fast Encoding and Sub-Millisecond DecodingarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09020v1PIC提出前馈INR图像编码器,实现快速编码和亚毫秒解码。Spheriverse: 3D Scene Understanding from Spherical Observations in the WildarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09012v1Spheriverse提供球面图像-LiDAR配对数据集,支持3D场景理解。A Joint 2D-3D Statistical Shape Model for Orthopedic ReconstructionarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09010v1联合2D-3D统计形状模型用于骨科重建,提升效率与精度。DXPR: Depth-Based Vision-LiDAR Cross-Modal Place Recognition Using Vision Foundation ModelsarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.09005v1DXPR用深度图像统一相机与LiDAR,实现跨模态位置识别。Concentrate After Imagination: Text-Conditioned Evidence Grounding for Partially Relevant Video RetrievalarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08999v1TRACE通过证据验证解决部分相关视频检索中的误匹配问题。Prior-free relative 6D pose estimation of multiple object instancesarXiv CV (cs.CV)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08949v1提出无先验相对6D姿态估计,无需模型或参考图即可多实例定位。Transformers as In-Context Samplers: From Closed-Form Diffusion to Estimation-Free SamplingarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08981v1证明Transformer可进行上下文采样,模拟生成式采样器。High-Magnetization Sampling at Low Temperatures: Ising Models and Bayesian Sparse Linear RegressionarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08873v1利用稀疏性设计高磁化采样算法,改进Ising模型和贝叶斯回归。Dynamic Latent Space Modeling of Inhomogeneous Poisson Network Processes with Applications to International RelationsarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08813v1动态潜空间模型用于非齐次泊松网络过程,可识别且可扩展。Optimal estimation for Functional Linear Regression with Noisy Discretized DataarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08671v1提出带噪离散函数型线性回归的最优估计方法,用傅里叶投影和惩罚最小二乘实现。A Lower Bound for the Heavy-Ball Method on Smooth Convex FunctionsarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08656v1证明重球法在光滑凸优化中无法达到Nesterov最优收敛率,给出下界。AlphaRJM: Reward-Jump Memory for Stochastic Return-Guided Alpha DiscoveryarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08581v1提出AlphaRJM,用奖励跳跃记忆解决公式化alpha发现的延迟反馈问题。Instability in Patient Clustering: A Multiverse Analysis of Unsupervised Clustering in the CENTER-TBI cohortarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08577v1多宇宙分析揭示创伤性脑损伤患者聚类结果对算法选择高度不稳定。Non-Adaptive 1-Bit Mean Estimation: Minimax Rates and the Sample-Interval TradeoffarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08564v1研究非自适应1比特均值估计的极小极大率,揭示样本区间权衡。The Exact Time-Uniform Rate Frontier for Stochastic Gradient Descent on Smooth Convex ObjectivesarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08537v1证明SGD在光滑凸目标上时间一致收敛率接近但达不到sqrt(log n/n)。Distribution-free inference on the number of changepointsarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08234v1提出无分布假设的变点数量推断方法,构造有限样本有效下界。Speed Limit for Information Acquisition in Stochastic Learning DynamicsarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08219v1推导SGD学习动力学中信息获取的Fisher信息流速度极限。Optimal Slice-Adaptive Tuning of Hybrid Slice SamplingarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08172v1分析混合切片采样平均迭代成本,提出最优切片自适应调参策略。GPU-Enabled Large-Scale Optimization Using Randomized Linear AlgebraarXiv ML (stat.ML)2026-09-08T04:00:00Zhttps://arxiv.org/abs/2609.08136v1介绍rlaopt,基于PyTorch的GPU随机线性代数大规模优化工具包。GPT-6 让 48 个网页验证码失效了,最聪明的 AI 和最笨的人类相遇了爱范儿2026-09-08T11:38:04Zhttps://www.ifanr.com/1679204?utm_source=rss&utm_medium=rss&utm_campaign=有报道称 GPT-6 成功绕过了 48 个网页验证码,使传统人机验证机制基本失效。这凸显了 AI 在视觉识别与自动化操作上的快速进步,也引发对现有反爬与安全验证体系有效性的讨论。Introducing CUDA Rust: Two Tracks for Writing GPU KernelsNVIDIA Developer Blog2026-09-08T12:00:00Zhttps://developer.nvidia.com/blog/introducing-cuda-rust-two-tracks-for-writing-gpu-kernels/NVIDIA 宣布推出 CUDA Rust,为开发者提供两条编写 GPU 内核的路径,正式将 Rust 引入原生 GPU 编程。CUDA C++ 与 CUDA Python 已是成熟的企业级工具链,此次扩展意味着 Rust 生态在 GPU 计算领域获得官方支持。Google DeepMind Maps 9 Billion Possible DNA VariantsIEEE Spectrum AI2026-09-08T14:00:05Zhttps://spectrum.ieee.org/alphagenome-atlasGoogle DeepMind 绘制了 90 亿种可能 DNA 变体的图谱。DNA 中大部分为非编码区,其中调控元件以复杂方式相互作用且效应因细胞和组织而异,理解 DNA 变化如何影响调控对理解大多数疾病至关重要。