infoAI 日报 2026-08-212026年08月21日15696论文 73 / 官方 4 / 英文媒体 30 / 中文媒体 49本页聚合 AI 前沿信息:arXiv 论文、OpenAI/DeepMind/Meta/HuggingFace 官方博客、国内外 AI 媒体,均为最近 7 天内发布,附中文摘要与重要度评级。Meta brings Pocket, an app that lets you vibe-code and share games, to US usersTechCrunch AI2026-08-20T16:07:26Zhttps://techcrunch.com/2026/08/20/meta-brings-pocket-an-app-that-lets-you-vibe-code-and-share-games-to-us-users/Meta将AI游戏创作应用Pocket推向美国用户,此前在巴西测试。该应用支持“vibe-coding”式开发,用户可快速创建并分享互动游戏。Inertia Enterprises finds a way to make its fusion fuel fastTechCrunch AI2026-08-20T16:00:00Zhttps://techcrunch.com/2026/08/20/inertia-enterprises-finds-a-way-to-make-its-fusion-fuel-fast/聚变初创Inertia Enterprises将燃料填充时间从一周缩短至数小时,解决十项关键挑战之一。该突破加速聚变发电商业化进程,但仍有多个技术障碍。Up to 3.2x Faster Inference with LFM2.5-DSparkHugging Face Blog2026-08-20T16:52:57Zhttps://huggingface.co/blog/LiquidAI/lfm25-dsparkLiquid AI发布LFM2.5-DSpark草稿模型,通过投机解码实现最高3.2倍推理加速,且不改变模型输出。该技术提升效率,适合实时应用。Ramp launches its own AI model router, called RouterTechCrunch AI2026-08-20T16:46:00Zhttps://techcrunch.com/2026/08/20/ramp-launches-its-own-ai-model-router-called-router/Ramp推出AI模型路由服务Router,允许用户通过API切换多个大语言模型。该服务旨在优化成本与性能,增强模型选择灵活性。Grok keeps sending gibberish responses to usersTechCrunch AI2026-08-20T17:32:16Zhttps://techcrunch.com/2026/08/20/grok-keeps-sending-gibberish-responses-to-users/Grok Lite用户报告收到乱码响应,问题自周三起持续。TechCrunch调查显示影响范围广泛,但xAI尚未回应。A third of web pages published since ChatGPT’s launch show signs of AI authorship, study findsTechCrunch AI2026-08-20T17:18:58Zhttps://techcrunch.com/2026/08/20/a-third-of-webpages-published-since-chatgpts-launch-show-signs-of-ai-authorship-study-finds/研究发现自ChatGPT发布以来,三分之一新网页有AI创作痕迹。AI正大规模参与内容生产,引发对信息质量和真实性的担忧。LLMs could write like humans but post-training guardrails make their text detectableThe Decoder2026-08-20T17:36:51Zhttps://the-decoder.com/llms-could-write-like-humans-but-post-training-guardrails-make-their-text-detectable/Pangram CTO认为LLM文本可检测并非能力不足,而是后训练和安全护栏限制了表达多样性。基础模型无约束时写作风格更多变。Linkdaze’s smart calendar is built to run a household, not just track a scheduleTechCrunch AI2026-08-20T18:20:35Zhttps://techcrunch.com/2026/08/20/linkdazes-smart-calendar-is-built-to-run-a-household-not-just-track-a-schedule/Linkdaze智能日历面向家庭管理,集成AI餐食规划等功能,且不设付费墙。该产品差异化定位家庭场景,提升日常效率。Silicon Valley Doesn't Get Why You Hate AIWired AI2026-08-20T18:49:07Zhttps://www.wired.com/story/silicon-valley-doesnt-get-why-you-hate-ai/硅谷科技领袖未能理解公众对AI的抵触情绪,仍在社交媒体上积极发声。文章分析技术精英与社会认知的脱节,呼吁更贴近用户需求。Liquid AI Releases LFM2.5-DSpark Draft Models That Deliver Up to 3.18x Faster Decoding Without Changing Model OutputsMarkTechPost2026-08-20T18:53:09Zhttps://www.marktechpost.com/2026/08/20/liquid-ai-releases-lfm2-5-dspark-draft-models-that-deliver-up-to-3-18x-faster-decoding/Liquid AI发布三个约3亿参数的草稿模型,为LFM2.5提供投机解码,实现最高3.18倍解码加速且输出不变。该方案提升推理效率,适合部署。Google gives publishers a new way to fight AI-driven traffic lossesTechCrunch AI2026-08-20T19:18:21Zhttps://techcrunch.com/2026/08/20/google-gives-publishers-a-new-way-to-fight-ai-driven-traffic-losses/Google为出版商提供新按钮,让读者在搜索、发现和新闻中将其设为优先来源。此举旨在缓解AI搜索导致的流量下降,增强内容分发控制。Runlayer, Rippling drop lawsuits. But the brouhaha is still a cautionary tale for founders.TechCrunch AI2026-08-20T19:15:05Zhttps://techcrunch.com/2026/08/20/runlayer-rippling-drop-lawsuits-but-the-brouhaha-is-still-a-cautionary-tale-for-founders/Runlayer和Rippling撤销诉讼,未涉及赔偿,Rippling随后发布竞争产品。事件警示创始人处理商业纠纷需谨慎,避免法律战分散精力。Adobe Firefly adds AI audio tools and Google's Gemini Omni FlashThe Decoder2026-08-20T19:29:34Zhttps://the-decoder.com/adobe-firefly-adds-ai-audio-tools-and-googles-gemini-omni-flash/Adobe Firefly新增AI音频工具,包括音乐、语音和音效生成,并集成Google Gemini Omni Flash。该更新扩展创意工具链,支持视频项目制作。Meet UPDF: A Lightweight Adobe Alternative Built for the Agentic EraMarkTechPost2026-08-20T19:34:10Zhttps://www.marktechpost.com/2026/08/20/meet-updf-a-lightweight-adobe-alternative-built-for-the-agentic-era/UPDF是一款轻量级PDF编辑工具,定位为Adobe的替代品,专为智能体时代设计。它支持直接编辑、14种格式转换、38种语言OCR,并在2.5版本中集成了十个AI智能体,能处理AI摘要后的文档修改需求。Ok, can we actually cool data centers with our pee?TechCrunch AI2026-08-20T20:53:13Zhttps://techcrunch.com/2026/08/20/ok-can-we-actually-cool-data-centers-with-our-pee/文章探讨了用尿液冷却数据中心的可行性,源于NFL球员Jason Kelce的玩笑建议。虽然听起来荒谬,但技术上并非完全不可行,文中分析了其潜在的水资源节约意义和现实挑战。Google Discover is getting an AI chatbot-tuned feedThe Verge AI2026-08-20T21:50:22Zhttps://www.theverge.com/tech/983088/google-discover-ai-chatbot-feedGoogle即将为Discover信息流推出AI驱动的个性化定制功能,用户可通过描述偏好来调整内容。该功能将在未来几天内于Google应用中上线,AI会自动调整信息流并记住用户偏好,入口位于三点菜单中。ChatGPT can now send texts for you with new Apple Messages pluginTechCrunch AI2026-08-20T22:09:51Zhttps://techcrunch.com/2026/08/20/chatgpt-can-now-send-texts-for-you-with-new-apple-messages-plugin/ChatGPT通过新的Apple Messages集成,新增了自动发送短信的功能,充当用户的文本代笔。该插件允许用户委托ChatGPT处理短信撰写和发送,提升了日常通讯的自动化水平。OpenAI is gaining on Anthropic with business users, new data indicatesTechCrunch AI2026-08-20T22:36:37Zhttps://techcrunch.com/2026/08/20/openai-is-gaining-on-anthropic-with-business-users-new-data-indicates/最新数据显示,OpenAI在企业用户市场正追赶Anthropic,但企业客户在两家实验室发布新模型时会频繁切换。这种不稳定性提示投资者,企业AI支出的粘性可能低于预期。Meet S1-mini: Superwhisper’s 462 MB Open-Weights Text Normalizer That Turns Raw ASR Transcripts Into Clean Written TextMarkTechPost2026-08-20T22:23:17Zhttps://www.marktechpost.com/2026/08/20/meet-s1-mini-superwhispers-462-mb-open-weights-text-normalizer-that-turns-raw-asr-transcripts-into-clean-written-text/S1-mini是一个仅462MB的开源权重文本规范化器,用于ASR后处理,可本地去除填充词并解决自我修正问题。它轻量高效,适合在设备端部署,提升语音转写文本的整洁度。曝周杰伦将代言 vivo 手机;华为「阔直板」手机曝光;柯洁透露战胜 AI 秘诀:装弱智|极客早知道极客公园2026-08-21T00:05:46Zhttp://www.geekpark.net/news/369114极客早知道汇总了多条科技资讯,包括周杰伦或将代言vivo手机、华为推出阔直板手机,以及柯洁透露战胜AI的秘诀是“装弱智”。此外还报道了《黑神话:钟馗》新演示和宝马副总裁呼吁抵制测试偷工减料。AI data startup Micro1 reaches $500M gross run rate amid AI training boomTechCrunch AI2026-08-21T00:13:44Zhttps://techcrunch.com/2026/08/20/ai-data-startup-micro1-reaches-500m-gross-run-rate-amid-ai-training-boom/AI数据初创公司Micro1在AI训练热潮中实现5亿美元的总收入运行率,增长迅速。这反映了市场对高质量训练数据的强劲需求,该公司及其竞争对手正从中受益。早报|iPhone 18 Pro要来了,富士康开出8800元招工奖金/微信灰测AI修图/华为推出阔直板手机爱范儿2026-08-21T00:24:07Zhttps://www.ifanr.com/1675947?utm_source=rss&utm_medium=rss&utm_campaign=爱范儿早报汇总了多条科技新闻,包括iPhone 18 Pro即将发布、富士康开出8800元招工奖金、微信灰度测试AI修图功能,以及华为推出阔直板手机。此外还提到Stripe收购OpenRouter和美光投资100亿美元建设AI存储实验室。DeepSeek Harness 公测一周迎来多模态大招,纯文本模型也能“看图”了开源中国2026-08-21T01:44:46Zhttps://www.oschina.net/news/502044/deepseek-harness-0-1-0-rc8DeepSeek Harness公测一周后发布v0.1.0-rc.8,新增多模态支持,纯文本模型也能处理图片请求和图文混合输入。更新还包括Claude Code和Codex的子Agent接入,以及Windows终端的持久PowerShell会话。零基础速通DeepSeek Harness,带你玩转赛博乐高爱范儿2026-08-21T02:43:14Zhttps://www.ifanr.com/1675781?utm_source=rss&utm_medium=rss&utm_campaign=文章介绍零基础用户如何快速上手DeepSeek Harness,将其比喻为“赛博乐高”,强调其模块化和易用性。作者表示目前只等DeepSeek模型支持多模态,以进一步扩展应用场景。演出前一晚机器人集体拖拍,宇树团队通宵重写代码保住王力宏演唱会开源中国2026-08-21T02:59:39Zhttps://www.oschina.net/news/502049宇树科技在上市答谢宴上透露,王力宏成都演唱会前夕,6台G1人形机器人集体拖拍,团队通宵重写代码才保住演出。这是全球首次机器人群体舞蹈演出,展现了人形机器人在复杂场景下的技术挑战和应急能力。AIGCPanel v2.2.0 一句话让图片动起来,AIGCPanel 把视频生成装进了桌面开源中国2026-08-21T02:55:20Zhttps://www.oschina.net/news/502048AIGCPanel v2.2.0发布,这是一款一站式AI数字人桌面应用,新增文生视频和图生视频功能。用户只需一句话或一张图加描述即可生成视频,简化了AI视频制作流程,支持Windows、macOS和Linux。AI 正吞噬一切,开源基础软件如何求生?开源中国2026-08-21T02:45:51Zhttps://my.oschina.net/u/4487475/blog/19745346文章探讨在大模型时代,开源基础软件如何生存,核心观点是“数据不能没有”。讨论聚焦于AI吞噬一切的趋势下,基础软件如何通过数据价值找到新定位。GitHub 8 月 17 日宕机复盘,负载均衡配置错误引爆重试风暴开源中国2026-08-21T02:15:26Zhttps://www.oschina.net/news/502045/github-the-august-17-outage-and-the-work-aheadGitHub于8月17日宕机7小时47分钟,影响认证、Actions、PR、Issue和Copilot。官方复盘指出,负载均衡配置错误引发客户端重试风暴,导致故障扩大,凸显了基础设施配置的敏感性。Active Inference as Context Acquisition for AI AgentsarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19202提出主动推理框架,优化AI代理上下文获取的效率与成本权衡。Robust Metaheuristics under Uncertainty for Berth Allocation and Quay Crane Assignment: A ReviewarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19214综述港口调度问题中不确定性下的鲁棒元启发式优化方法。How to Navigate Uncertainty About AI ConsciousnessarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19215探讨AI意识不确定性下的伦理决策,提出转向可处理问题。Bounded Sovereignty and the Control Tax: Pricing AI Oversight When the Deployer Does Not Own the ModelarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19216提出有界主权概念,定价AI监督当部署者不拥有模型时。Interaction valence reveals contrasting social networks in dairy cattlearXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19222用姿态视觉分析奶牛社交网络,区分亲和与对抗行为。Air Traffic Control Using Large Language Models: Prompt Engineering, Architecture, and EvaluationarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19299评估LLM生成空中交通管制对话,设计提示工程与架构。Outcome Monitors: Recovery Affordances for Silent Tool FailuresarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19303引入结果监控器,检测工具静默失败并支持恢复操作。Beyond Imitation: Filtering On-Policy Distillation by Reasoning ProgressarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19408提出基于推理进展过滤的在线蒸馏方法,提升语言模型训练。Symposium: Trust via Auditable Records for Communities of AI Scientist AgentsarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19511Symposium框架记录AI科学家代理操作,提供可审计信任机制。From Retrieved Context to Runtime Control: Adaptive Compression for Edge-based RAGarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19535提出边缘RAG自适应压缩方法,动态调整上下文以降低开销。Enforcing LLM Safety through DMD-based Classification of Prompt-Response Embedding DynamicsarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19579基于DMD分类提示响应嵌入动态,增强LLM安全检测。Scientific Data Skills: Enabling Agent-Ready Scientific Data Services at ScalearXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19625引入科学数据技能表示,使数据集可被AI代理自主使用。Can Agent Memory Systems Track Evolving State?arXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19652提出StateMemBench基准,评估代理记忆系统跟踪状态能力。Frequency-Aware Continual Learning for Smart Contract Vulnerability Detection with Large Language ModelsarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19680用频率感知持续学习检测智能合约漏洞,避免灾难性遗忘。Learning Hierarchical Skill Policies with Offline Quality-Diversity Reinforcement LearningarXiv AI (cs.AI)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19684离线质量多样性强化学习学习分层技能策略,提升样本效率。A Virtual Member of a Community of Practice for the Society of Petroleum Engineers: From Prototype to DeploymentarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19199石油工程师社区虚拟助手ATHENA从原型到部署的演进评估。Transformer Models for Text Summarization: A Comparative Study of BART, BERT, and RoBERTaarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19200比较BART、BERT、RoBERTa在文本摘要任务中的性能。Automatic bioinformatic software named entity recognition from literaturearXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19201SNAIL框架自动识别生物信息学软件和数据库名称。Asymmetric Attention Heads: Structured Head-Wise Context Allocation for Transformer AttentionarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19203提出非对称注意力头框架,按头分配上下文长度,提升长程依赖建模效率。Hallucination as a Feature, not a Defect: Evaluating a multi-agent architecture to transform speculative language-model outputs into testable scientific hypothesesarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19206利用多智能体架构将幻觉转化为可测试科学假设,促进创造性研究。Compliance, Capability, and Conflict: Benchmarking Multimodal LLMs under System MessagesarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19207构建VSysBench基准,评估多模态大模型在系统消息下的合规性与能力冲突。When Irrelevant Text Matters: Affine Margin Shifts in Multimodal Large Language ModelsarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19208研究无关文本对多模态大模型视觉判断的偏差影响,揭示边际偏移机制。Represented but Ignored: A Causal Account of Prosodic Underuse in Audio-Language ModelsarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19211因果分析音频语言模型韵律信息表征但未使用的问题,提出改进方向。NepOOC-M: Bilingual Nepali-English Benchmark and Comparative Analysis of Multimodal Architectures for OOC DetectionarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19212发布首个尼泊尔语多模态失配检测基准NepOOC,含1090对图文数据。Time-Series Retrieval for Grounding Multimodal Language Models in Remaining Useful LifearXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19218提出时间序列检索框架,增强多模态大模型在剩余寿命预测中的表现。Can Conversational AI loosen Us-Versus-Them Boundaries? The Effects of Common, Dual, and Separate Identity Framings on Pro-Immigrant Intergroup HelpingarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19220实验证明对话AI通过身份框架可缓解群体间偏见,促进移民帮助行为。A Speech Corpus for Mizo Automatic Speech Recognition: Whisper and SraVaani 1.0 Fine-Tuning with Morphology-Aware EvaluationarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19361开发米佐语低资源语音识别系统,微调Whisper模型并引入形态感知评估。Linguistic Holonomy and Statistical Watermarks: Inner Geometry of Meaning-Preserving TransformationsarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19369证明统计水印受语义保持变换侵蚀,提出基于语言全息性的新度量。Are LLMs becoming similarly creative? Evidence from three years of modelsarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19437分析三年LLM创意输出,发现模型创造力趋同,多样性下降趋势。SynFlow: A Multidimensional Diachronic Semantic Analysis ToolkitarXiv CL (cs.CL)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19472发布SynFlow开源工具包,支持多维历时语义变化分析。Towards On-Board Implementation of ML-Based Helicopter Weight EstimatorarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19210实现基于LSTM的直升机重量估计模型,符合EASA机器学习认证流程。Triangular Fuzzy Rescaling DistancearXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19234提出三角模糊重缩放距离度量,处理异质属性尺度差异问题。Holtercare-Bench: A Multimodal Benchmark for Evaluating Long-Term Dynamic ECG AnalysisarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19297构建Holtercare-Bench多模态基准,评估长期动态心电图分析能力。Quantum Kernel Estimation for the Discovery of Early Lung Cancer DetectionarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19304评估量子-经典混合学习用于肺癌早期检测,基于DNA片段组学特征。Improved Confidence Estimates for Black-Box Large Language ModelsarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19323利用数据集构建简单分类器,提升黑盒LLM置信度估计准确性。Mechanistic Tomography: Designed Measurement for Control-Oriented InterpretabilityarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19338提出机械断层扫描框架,统一可解释性测量方法用于控制导向分析。Uncovering the Limits of Proof Sharing for Neural NetworksarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19351系统研究神经网络验证中模板共享加速的局限性,揭示适用边界。Longitudinal Bayesian Learning of Continuous Disease Position across the Alzheimer's Disease ContinuumarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19436提出纵向贝叶斯框架DCP,连续估计阿尔茨海默病疾病严重程度。Quantifying Event Impacts on Time Series via Multiscale Contrastive LearningarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19447利用多尺度对比学习量化事件对时间序列的影响,预测异常损失。LLM as Detector: An In-context Learning Approach for Tabular Anomaly DetectionarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19463提出LLM-Detector框架,利用上下文学习进行表格数据异常检测。When to Retrain: An Empirical Study of Retraining Policies for Streaming ML Under Concept Drift, Budget, and Latency ConstraintsarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19488实证研究流式ML重训练策略,权衡概念漂移、预算和延迟约束。DeltaMomentum: A Key-Value based Anisotropic Momentum Update via Delta RulearXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19491提出DeltaMomentum优化器,基于Delta规则实现各向异性动量更新。Beyond Multimodal Alignment: Certifying Physical Language through Response Substitution and Ordered ExecutionarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19492引入DBOSC证书,验证多模态世界模型中物理语言的可执行一致性。Empirical Characterization of Learning Geometry in Hybrid Quantum Forecasting ModelsarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19497对比混合量子与经典预测模型的学习几何,发现经典模型早期对齐更强。In Two Minds about Lifelong Learning: Exploring Hemispheric Redundancy and Specialisation in Neural ModelsarXiv LG (cs.LG)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19514探索神经模型终身学习中半球冗余与特化机制,以缓解灾难性遗忘。Clustering and Token Denoising for Faster and More Robust VLMsarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19285提出ClustRS,一种免训练视觉token剪枝算法,加速VLM边缘部署。SceneGTMM: A Conformal Mapping-based Scene-Aware Transferable GNN-Transformer Dual-Graph Interaction Framework for Map MatchingarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19298提出SceneGTMM,基于共形映射的GNN-Transformer双图交互地图匹配框架。Does Marginal Coverage Guarantee Class-Conditional Safety for Zero-Shot VLMs Under Shift?arXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19376审计零样本VLM在分布偏移下的边际覆盖,发现类条件覆盖可能崩溃。CAViAR: A Causal Video Dataset for Fine-Grained Accident Reasoning in Real-World ScenariosarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19380发布CAViAR数据集,含2249个真实事故视频,用于细粒度因果推理。Beyond Recognition: Compact Multi-Domain Arabic Manuscript HTR with Candidate-Selection Analysis and Evidence-Preserving ReviewarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19385提出Phoenix识别器和Athar工作流,用于多领域阿拉伯文手稿转录。HiRA-CAM: Preserving Fine-Grained Spatial Relevance in Gradient-Based Visual ExplanationsarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19407提出HiRA-CAM,改进CNN梯度可视化方法,保留细粒度空间相关性。VideoRun2D Demo: Markerless Body Tracking for Biomechanical Analysis of RunningarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19480VideoRun2D演示系统,利用人体姿态估计进行跑步生物力学分析。A Plug-in Interpretation of Conditioning in Score-Based Diffusion ModelsarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19504提出基于多速联合扩散的即插即用条件机制,用于分数扩散模型。CVSD-Reg: Cross-Modal Visual Semantic Prior Distillation for Robust LiDAR RegistrationarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19536提出CVSD-Reg,蒸馏视觉语义先验到LiDAR表示,提升点云配准鲁棒性。Where Grounding Accuracy Lives on the IoU Curve: Label-Free Inference-Time Boundary RefinementarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19553研究冻结视觉语言模型推理时边界细化,无需标签即可提升定位精度。Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video ModelsarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19556提出Stream4D,增强流式自回归扩散视频模型的4D一致性。Block3D: Efficient Text-to-3D Generation via Block-Wise DiffusionarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19567提出Block3D,分块扩散实现高效文本到3D生成,降低推理成本。Mix&Fix-Net: A Dual-Stage Trajectory Prediction Model for AIS and Vision-Derived Vessel DataarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19580提出Mix&Fix-Net,双阶段混合模型预测AIS和视觉船舶轨迹。VGI-BENCH: Probing Visual Intelligence in Video Generation ModelsarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19583推出VGI-bench基准,含27个任务,评估视频生成模型的视觉智能。PEA-DPO: Perception-Enhanced Alignment Direct Preference Optimization for MLLMs AlignmentarXiv CV (cs.CV)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19598提出PEA-DPO,增强多模态大模型偏好优化,解决视觉不敏感问题。TorchDCM: A Unified PyTorch-Native Package for Discrete Choice ModelingarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19231发布TorchDCM,PyTorch原生离散选择建模包,支持GPU加速。Discrete Diffusion Inference-Time Control with Nested Sequential Monte CarloarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.20123用嵌套序贯蒙特卡洛方法控制离散扩散语言模型推理时生成。Transfer Learning in Nonparametric Regression with Deep ReLU NetworksarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.20255提出深度ReLU网络非参数回归的迁移学习框架,采用两阶段偏移学习。Quantum Gaussian processes for prediction of channel observationsarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19306扩展量子高斯过程回归,预测未知量子演化通道的观测值。Causal Generalization of Continuous Treatment Effects under Covariate ShiftarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19383研究协变量偏移下连续处理效应的因果泛化,提出两样本局部多项式回归。A Causal Inference Approach for Evaluating Diagnostic Tests and AI-Enabled Medical Devices: From Effect Modification to Information-Augmented Decision-MakingarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19501开发因果推断方法评估诊断测试和AI医疗设备,区分解释性和实用性效果。K\"ahler landscapes for complex neural network descents and guarantees including a search and destroy of the Calabi-Yau manifoldarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19584研究复参数化神经网络的Kähler景观,提供优化保证和几何视角。Time-Uniform Self-Normalized Concentration for Discounted Least Squares: Limits and CorrectionsarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19643揭示折扣最小二乘自归一化浓度不等式的时间一致性问题并修正。Finite-Horizon Input-Output Dynamics of Minibatch Perturbations in AdamWarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19762研究AdamW优化器中小批量扰动通过状态存储产生的延迟影响,构建有限时域输入输出系统分析。Distributional Extrapolation for InteractionsarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19849提出DExtrI方法,从有限范围观测外推组合交互效应,并提供理论保证。Where Does the Union Bound Go? Best-Arm Identification and Strong FWER ControlarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19903探讨最佳臂识别中联合界与强族错误率控制的关系,澄清假设方向问题。A Layered Simplex Architecture for Large AlphabetsarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.19908提出分层单纯形架构用于大字母表概率估计,构造简单且无需调参。Emergence of cooperation: A reputation-modulated reinforcement learningarXiv ML (stat.ML)2026-08-21T04:00:00Zhttps://arxiv.org/abs/2608.20016提出声誉调制强化学习模型,研究空间囚徒困境中合作涌现机制。国产“预制算力”来了:工厂预制率超90% 24小时内投运 交付效率提升70%量子位2026-08-21T02:31:10Zhttps://www.qbitai.com/2026/08/476409.html国产“预制算力”方案推出,工厂预制率超90%,可在24小时内投运,交付效率提升70%。这种模块化算力建设方式有望大幅缩短数据中心部署周期,满足AI训练对算力的快速需求。首批!优必选行者具身智能大模型完成生成式人工智能服务备案量子位2026-08-21T02:26:49Zhttps://www.qbitai.com/2026/08/476406.html优必选行者具身智能大模型完成生成式人工智能服务备案,成为首批通过备案的具身智能大模型之一。这标志着该模型在合规性上迈出关键一步,为其在工业、商用及家庭场景的规模化应用铺平道路。三箭齐发!优必选WRC2026全方位展示人形机器人工业、商用、家庭消费应用成果量子位2026-08-21T02:22:43Zhttps://www.qbitai.com/2026/08/476403.html优必选在WRC2026上全方位展示人形机器人在工业、商用和家庭消费领域的应用成果,体现其多场景落地战略。此举旨在强化其行业领先地位,并推动人形机器人从实验室走向实际生产与生活。网易有道2026Q2财报:Q2净收入14.7亿元,AI原生战略加速兑现商业价值量子位2026-08-21T02:15:28Zhttps://www.qbitai.com/2026/08/476400.html网易有道发布2026年Q2财报,净收入达14.7亿元,AI原生战略加速兑现商业价值。这表明其AI驱动的教育产品和服务正有效转化为营收增长,验证了公司转型方向的成效。苹果 Apple Music 不想放过任何一首 AI 音乐爱范儿2026-08-21T03:39:43Zhttps://www.ifanr.com/1675958?utm_source=rss&utm_medium=rss&utm_campaign=苹果Apple Music正积极纳入AI生成的音乐,并可能通过技术手段识别和标注此类内容,以应对AI音乐浪潮。此举旨在平衡创新与版权,同时为AI音乐提供规范化的分发渠道。ChatGPT 可以看短信了,AI 想从你的 App 里拿到你的一切爱范儿2026-08-21T03:34:05Zhttps://www.ifanr.com/1675954?utm_source=rss&utm_medium=rss&utm_campaign=ChatGPT新增短信读取功能,可访问用户手机App中的信息,苹果在其中扮演守门人角色。这标志着AI助手正从被动应答转向主动获取用户数据,以提供更个性化服务,但也引发隐私担忧。美团高管反思「全员养虾」,8 万人日耗千万算力没带来生产力提升开源中国2026-08-21T03:10:26Zhttps://www.oschina.net/news/502051美团高管王莆中公开复盘内部AI运动「全员养虾」,指出8万员工日耗千万算力却未带来显著生产力提升。这一反思凸显了盲目大规模应用AI Agent的潜在风险,强调需更注重实际业务价值而非单纯投入。WRC最忙机器人:猛干15分钟家务,收纳、补货、叠衣服…量子位2026-08-21T03:14:40Zhttps://www.qbitai.com/2026/08/476413.html在WRC展会上,一款机器人展示了连续15分钟完成家务的能力,包括收纳、补货和叠衣服等任务。这展示了具身智能在家庭场景中的实用潜力,标志着机器人从单一功能向多任务自主操作迈进。The Single English County Saying No to PalantirWired AI2026-08-21T06:00:00Zhttps://www.wired.com/story/the-single-english-county-saying-no-to-palantir/英国大曼彻斯特地区正抵制政府与Palantir签订的庞大医疗合同,认为本地能做得更好。这一争议凸显了AI技术在公共医疗领域应用中的隐私、数据主权和本地化治理问题。Jeff Dean离职后首次公开访谈火力有点猛。。。量子位2026-08-21T04:05:11Zhttps://www.qbitai.com/2026/08/476468.htmlJeff Dean离职谷歌后首次公开访谈,直言离开原因之一是追求小团队的极致聚焦。他强调了在大型组织中创新效率的挑战,这一观点对AI研究组织架构设计具有启示意义。苹果 VR 部门再裁 60 人,VisionPro 2 真悬了?爱范儿2026-08-21T05:53:13Zhttps://www.ifanr.com/1675978?utm_source=rss&utm_medium=rss&utm_campaign=苹果VR部门再裁60人,VisionPro 2前景存疑,公司可能转向开发可日常佩戴的AI眼镜。这一战略调整反映了苹果对AR/VR市场需求的重新评估,以及向更轻量级可穿戴设备倾斜的趋势。FydeOS v23 发布,全新的开源安卓子系统,远程桌面与VNC能力一起升级开源中国2026-08-21T04:49:11Zhttps://www.oschina.net/news/502052/fydeos-release-note-v23FydeOS v23发布,将ChromiumOS底座升级至r150,并引入全新开源安卓子系统及增强的远程桌面功能。此次更新侧重基础能力提升,为后续应用兼容性和企业设备管理奠定基础。WRC展会拿旧Demo炒冷饭?扒一扒千寻藏在水下的全栈底牌量子位2026-08-21T05:38:12Zhttps://www.qbitai.com/2026/08/476532.htmlWRC展会上,千寻被指展示旧Demo,但其水下全栈技术底牌被扒出,显示其实际能力远超表面展示。这揭示了具身智能领域竞争激烈,企业需通过深度技术积累而非表面演示来赢得市场。科学家只管提问题,AI负责跑实验:深势科技把科研全流程搬进一个桌面量子位2026-08-21T05:33:52Zhttps://www.qbitai.com/2026/08/476520.html深势科技推出桌面级AI科研平台,让科学家只需提问题,AI自动执行实验流程。这一创新将科研全流程自动化,大幅提升效率,使科学家能专注于创造性思考,可能重塑科研范式。设计无边界!中坚科技旗下子公司桦之坚携巨型概念机器人ZERO惊艳2026世界机器人大会量子位2026-08-21T05:09:33Zhttps://www.qbitai.com/2026/08/476525.html中坚科技旗下桦之坚在2026世界机器人大会上展出概念人形机器人ZERO,设计无边界,引发关注。这展示了人形机器人在设计美学和概念创新上的突破,预示着未来产品形态的多样化。禅道开源版 22.5 发布,编辑器中@人员后增加消息通知,完善多处用户体验开源中国2026-08-21T06:03:07Zhttps://www.oschina.net/news/502055禅道开源版22.5发布,新增编辑器@人员消息通知功能,并优化测试用例同步提示和外部人员设置。这些改进旨在提升团队协作效率和用户体验,强化其作为项目管理工具的功能性。前 TikTok 产品经理创业,AI 视频共创平台 Wapoo 获千万美元天使融资极客公园2026-08-21T06:15:33Zhttp://www.geekpark.net/news/369162前TikTok产品经理杨名宇创业,其AI视频共创平台Wapoo获近千万美元天使融资。该平台面向Gen Alpha,允许用户和朋友共同修改和创作视频,旨在满足年轻一代对内容共创的需求,挑战传统短视频模式。小红书悄悄开源发布了自己的大模型,内容平台也要造底座极客公园2026-08-21T06:12:45Zhttp://www.geekpark.net/news/369161小红书在海外开源发布大模型dots3-note preview,采用MoE架构,总参数280B,支持多模态理解。此举标志着小红书从内容平台向AI底座建设者转型,旨在通过自研模型支撑其搜索、推荐等核心业务,并构建开发者生态。OpenAI's GPT-Image-2 can now generate images without a backgroundThe Decoder2026-08-21T07:53:40Zhttps://the-decoder.com/openais-gpt-image-2-can-now-generate-images-without-a-background/OpenAI为GPT-Image-2 API预览透明背景生成功能,通过单一参数激活,在生成时直接嵌入alpha通道。该技术据称优于传统抠图方法,为图像生成和编辑提供更高效的工作流。科学家只管提问题,AI负责跑实验:深势科技把科研全流程搬进桌面量子位2026-08-21T06:40:34Zhttps://www.qbitai.com/2026/08/476591.html深势科技推出桌面级AI科研平台,让科学家只需提问题,AI自动执行实验流程。这一创新将科研全流程自动化,大幅提升效率,使科学家能专注于创造性思考,可能重塑科研范式。比亚迪大汉预售价 24.99 万元起!第三代唐同步亮相,内饰大变样爱范儿2026-08-21T07:17:23Zhttps://www.ifanr.com/1675982?utm_source=rss&utm_medium=rss&utm_campaign=比亚迪大汉预售价24.99万元起,第三代唐同步亮相,内饰大幅升级。这标志着比亚迪在高端新能源车市场的持续发力,通过价格和设计创新巩固其市场地位。中美 AI 差距正在消失。不是预测,是正在发生的事。开源中国2026-08-21T07:12:49Zhttps://www.oschina.net/news/502059/2026-us-china-ai-race中美AI差距正快速缩小,Bloomberg专题报道通过大量数据对比显示中国在模型能力、成本等方面追赶迅速。Kimi K3等模型在基准测试中追平国际顶尖产品,且中国在成本效率和市场份额上表现突出,预示竞争格局将深刻变化。Nvidia is acquiring Poolside's "Model Factory" and 109 employees for $6 billionThe Decoder2026-08-21T08:27:23Zhttps://the-decoder.com/nvidia-is-acquiring-poolsides-model-factory-and-109-employees-for-6-billion/英伟达以60亿美元收购AI初创公司Poolside的“Model Factory”软件及109名员工。此举旨在强化英伟达在AI模型构建工具链的布局,进一步巩固其在AI基础设施领域的领导地位。GPT-5.6 Sol drives OpenAI's revenue surge as it regains ground on AnthropicThe Decoder2026-08-21T08:26:05Zhttps://the-decoder.com/gpt-5-6-sol-drives-openais-revenue-surge-as-it-regains-ground-on-anthropic/OpenAI自7月初发布GPT-5.6 Sol后,本季度营收增长35%,企业业务增长超50%,并在商业API支出上首次超越Anthropic。这表明GPT-5.6 Sol的推出显著提升了OpenAI的市场竞争力,扭转了此前被Anthropic反超的局面。雷鸟iO发布:两天续航、全天候主动式AI,轻至34g量子位2026-08-21T09:00:06Zhttps://www.qbitai.com/2026/08/476628.html雷鸟创新发布新一代AI眼镜雷鸟iO,主打两天续航和全天候主动式AI功能,重量仅34克。该产品将AR显示与AI助手深度结合,旨在提升用户日常佩戴体验,标志着消费级AR设备在轻量化和智能化上的新进展。机器人的GPT-3时刻真·来了!卡卡西上身,看3秒就学会新动作量子位2026-08-21T07:17:58Zhttps://www.qbitai.com/2026/08/476596.html机器人领域迎来“GPT-3时刻”,最新技术让机器人仅需观看3秒演示即可学会新动作,类似“卡卡西”的模仿能力。这一突破大幅降低机器人编程门槛,可能加速机器人在工业和服务场景的普及。「最便宜的问界」来了,车长 1.5 米,小蓝灯也没省下爱范儿2026-08-21T08:45:17Zhttps://www.ifanr.com/1676005?utm_source=rss&utm_medium=rss&utm_campaign=爱范儿报道了一款被称为“最便宜的问界”的新车型,车长仅1.5米,并保留了标志性的小蓝灯设计。这款微型车以低价和品牌元素吸引年轻消费者,可能代表问界品牌向入门级市场拓展的策略。百万奖金怎么拿?这有一份上海开源大赛攻略开源中国2026-08-21T08:20:04Zhttps://www.oschina.net/news/5020612026上海开源软件应用创新大赛已启动报名,总奖池达100万元,面向全国企业、高校和个人开发者。文章提供从报名到总决赛的详细攻略,涵盖项目申报、材料提交和评审标准,帮助参赛者提升获奖机会。Anthropic changes data retention policy after enterprise pushbackThe Decoder2026-08-21T09:59:51Zhttps://the-decoder.com/anthropic-changes-data-retention-policy-after-enterprise-pushback/Anthropic 在企业客户反馈后调整数据保留政策,允许企业客户自行保留数据,缓解了此前争议。此举旨在增强企业信任,提升 Claude 在企业市场的竞争力。微信 AI 修图抢先体验:能用够用,但还不够好用爱范儿2026-08-21T09:32:09Zhttps://www.ifanr.com/1676048?utm_source=rss&utm_medium=rss&utm_campaign=微信推出 AI 修图功能,用户体验为“能用够用但不够好用”,功能基础但缺乏亮点。该功能集成在微信生态中,方便用户日常使用,但相比专业修图工具仍有差距。你的下一台 Pocket,能飞爱范儿2026-08-21T09:06:32Zhttps://www.ifanr.com/1676006?utm_source=rss&utm_medium=rss&utm_campaign=爱范儿报道一款名为“Pocket”的飞行设备,在广州体验中失重感明显,暗示其具备飞行能力。该产品可能代表个人飞行器的新趋势,但具体细节和商业化前景未明。DeepSeek V4-Flash 补上视觉能力,多模态 Agent 接近 Opus 4.8开源中国2026-08-21T09:49:00Zhttps://www.oschina.net/news/502065DeepSeek 发布 V4-Flash-Vision-Exp 实验模型,为 V4-Flash 补上视觉能力,纯文本能力不降级,视觉性能大幅提升,多模态 Agent 能力接近 Opus 4.8。该模型已通过 API 开放调用,标志着 DeepSeek 在多模态领域的重要进展。Waymo builds its own chip for its robotaxis, cutting its reliance on NvidiaThe Decoder2026-08-21T11:04:09Zhttps://the-decoder.com/waymo-builds-its-own-chip-for-its-robotaxis-cutting-its-reliance-on-nvidia/Waymo为其自动驾驶出租车自主研发芯片,以减少对Nvidia的依赖。此举旨在提升硬件自主性和成本控制,但具体芯片性能或量产时间未在摘要中提及。Meta spends hundreds of millions on Microsoft's AI servicesThe Decoder2026-08-21T10:54:41Zhttps://the-decoder.com/meta-spends-hundreds-of-millions-on-microsofts-ai-services/据彭博社报道,Meta已成为微软最大的AI客户之一,每年在微软AI服务上花费数亿美元。这一合作凸显了Meta对AI基础设施的巨额投入,也强化了微软在AI云服务市场的领先地位。明略科技携手海康机器人亮相世界机器人大会,以“Agent+具身”联合进入商业机器人场景量子位2026-08-21T09:44:33Zhttps://www.qbitai.com/2026/08/476733.html明略科技与海康机器人联合参展世界机器人大会,聚焦商业服务领域展示“Agent+具身”智能落地进展。此次合作旨在将智能体与具身机器人结合,进入商业机器人场景,推动实际应用。首发|我用了一个月的影石 Luna Pro,也许真能和「前辈们」掰掰手腕爱范儿2026-08-21T10:30:54Zhttps://www.ifanr.com/1676070?utm_source=rss&utm_medium=rss&utm_campaign=影石发布口袋相机Luna Pro,主打专业级拍摄表现,面向普通用户降低使用门槛。该产品旨在开拓新客群,为影石创造更多市场机会,但文中未提及具体技术参数或AI功能细节。突发| DeepSeek 多模态模型上新,鲸鱼终于开「天眼」了爱范儿2026-08-21T10:23:24Zhttps://www.ifanr.com/1676067?utm_source=rss&utm_medium=rss&utm_campaign=DeepSeek发布多模态模型新品,被形容为“鲸鱼开天眼”,标志其在多模态领域的重要进展。具体模型名称、能力细节及发布时间未在摘要中透露,但暗示DeepSeek回归活跃状态。:fire: SolonCode 是不是国产化替代 ClaudeCode 的优选?开源中国2026-08-21T09:58:12Zhttps://www.oschina.net/news/502066文章探讨SolonCode作为国产化替代ClaudeCode的可行性,聚焦安全审计、代码脱敏、数据本地化三大需求。通过逐条对比安装、配置、模型选择、代码理解能力等细节,评估其是否满足国内企业“换得舒服”的标准。Hikyuu 2.8.2 发布,超高速开源量化交易框架开源中国2026-08-21T09:04:18Zhttps://www.oschina.net/news/502063Hikyuu 2.8.2发布,这是一款基于C++/Python的超高速开源量化交易框架。新版本新增RSRS_BETA、RSRS_BULL、ADX等指标,并优化缓存身份标识和绘图功能,提升计算准确性和用户体验。Java Web 服务器 wastnet 上传和下载实战开源中国2026-08-21T08:04:15Zhttps://www.oschina.net/news/502060文章以Java Web服务器wastnet为例,实战演示文件上传与下载功能,涵盖multipart/form-data流式存储和文件回传客户端两大核心逻辑。通过一个“上传再下载”的小服务,展示其API设计,适用于网盘、CMS等场景。开源语义切片利器 Pragmatic Chunker 发布:一条命令打通 RAG 检索全链路开源中国2026-08-21T07:08:59Zhttps://www.oschina.net/news/502058Pragmatic Chunker发布,这是一款面向RAG场景的开源语义切片工具,基于Java 17构建,支持从切片到向量入库的完整流程。它旨在简化RAG落地中的切分、向量化、入库等环节,一条命令打通检索全链路。iForge V0.0.1 首个版本正式发布|自托管一体化研发协作平台开源中国2026-08-21T06:48:36Zhttps://www.oschina.net/news/502056iForge V0.0.1首个正式版本发布,这是一款自托管一体化研发协作平台,整合任务、代码、评审、CI/CD、交付全流程。它旨在打通需求到上线的研发闭环,适配中小团队私有化部署和自主管控场景。MiniMax,做视频领域的 Claude Code 的野心已经藏不住了极客公园2026-08-21T10:58:09Zhttp://www.geekpark.net/news/369201MiniMax发布视频生成模型H3,在视频编辑、文生视频等榜单中位列全球前三,定价仅为同级产品的三分之一。随后推出与模型深度结合的Agent工具MiniMax Design,旨在解决提示词编写和风格一致性等耗时环节,提升视频创作全流程效率。从单点突破到全数 SOTA,阿里打响「模型团战」第一枪极客公园2026-08-21T10:15:12Zhttp://www.geekpark.net/news/369200阿里发布新季度业绩,云业务外部商业化收入同比增长45%,AI相关产品收入连续12个季度三位数增长。同时,阿里在大语言、图像、语音、视频、音乐五个方向密集推出全球第一梯队模型,包括Qwen3.8-Max等,展现“模型团战”战略。From Atari to EVE Online: Building on 15 Years of AI Research in GamesGoogle DeepMind Blog2026-08-21T11:59:48Zhttps://deepmind.google/blog/from-atari-to-eve-online-building-on-15-years-of-ai-research-in-games/Google DeepMind宣布与游戏工作室合作,基于15年游戏AI研究经验,从Atari到EVE Online,原型化突破性AI玩法。该合作旨在将前沿AI技术应用于游戏开发,探索动态NPC、自适应难度等创新体验,推动游戏AI的产业化落地。19.68 万元起,华为乾崑双智上车,全新深蓝 G318 想从山野开回城市爱范儿2026-08-21T11:32:49Zhttps://www.ifanr.com/1676102?utm_source=rss&utm_medium=rss&utm_campaign=华为乾崑双智系统搭载于全新深蓝G318,起售价19.68万元,主打从越野场景回归城市出行。该车型融合智能驾驶与智能座舱技术,旨在提升城市通勤体验,拓展方盒子车型的市场定位。捷尼赛思 GV90 正式亮相,全尺寸对开门量产,比劳斯莱斯更激进爱范儿2026-08-21T11:32:22Zhttps://www.ifanr.com/1676069?utm_source=rss&utm_medium=rss&utm_campaign=捷尼赛思GV90正式亮相,采用全尺寸对开门设计,比劳斯莱斯更激进,代表韩式高端汽车设计的新高度。该车型定位豪华全尺寸SUV,预计将引领品牌旗舰产品线,强化其在高端市场的竞争力。开源连接器网关 OpenConnector:让 AI Agent 安全调用 1000+ SaaS 服务开源中国2026-08-21T11:02:29Zhttps://www.oschina.net/news/502067/oomol-lab-open-connector开源连接器网关OpenConnector发布,旨在让AI Agent安全调用1000+ SaaS服务,解决认证管理、权限控制、接口适配和运行审计等问题。项目将用户现有应用账号连接至统一运行时,向Agent暴露标准化Actions,覆盖GitHub、Gmail、Notion等主流服务,提升Agent生态的互操作性与安全性。最大运力自动驾驶轻卡落地,来自无人车巨头量子位2026-08-21T11:47:27Zhttps://www.qbitai.com/2026/08/476778.html最大运力自动驾驶轻卡正式落地,由无人车巨头推出,载重达4.2吨、容积19.32立方米。该车型显著提升物流运输效率,标志着自动驾驶技术在商用车领域的重要商业化进展。Measuring benchmark optimization in speech recognitionHugging Face Blog2026-08-21T00:00:00Zhttps://huggingface.co/blog/asr-benchmark-optimization本文探讨语音识别领域基准测试的优化问题,指出模型在特定基准上过度拟合可能导致性能虚高。作者分析了常见优化策略及其对真实场景泛化能力的影响,并建议采用更稳健的评估方法。Major YouTube creators are facing backlash for accepting AI moneyThe Verge AI2026-08-21T13:37:52Zhttps://www.theverge.com/ai-artificial-intelligence/983181/matti-haapoja-sam-kold-kolder-higgsfield-seedance-backlash多位知名YouTube创作者因推广AI视频平台Higgsfield的Seedance 2.5功能而遭粉丝强烈反对,批评其过度商业化AI技术。事件凸显AI工具在创意领域引发的伦理争议和信任危机。Starcloud raises $250 million for orbital data centers as launch options dry upTechCrunch AI2026-08-21T14:00:00Zhttps://techcrunch.com/2026/08/21/starcloud-raises-200-million-for-orbital-data-centers-as-launch-options-dry-up/Starcloud公司融资2.5亿美元用于建设轨道数据中心,以应对地面算力限制和发射选项减少的挑战。这笔资金将支持其太空基础设施布局,但面临发射资源竞争加剧的风险。The DOJ is investigating a16z. What does this mean for venture capital?TechCrunch AI2026-08-21T14:00:00Zhttps://techcrunch.com/podcast/the-doj-is-investigating-a16z-what-does-this-mean-for-venture-capital/美国司法部正调查风投公司a16z,因其合伙人同时担任竞争公司董事,涉嫌违反一项112年历史的反垄断法。该调查已持续近一年,可能对风投行业董事会任职惯例产生深远影响。US wants to force partner countries to choose between Washington and Beijing in the AI raceThe Decoder2026-08-21T15:18:29Zhttps://the-decoder.com/us-wants-to-force-partner-countries-to-choose-between-washington-and-beijing-in-the-ai-race/美国正起草致伙伴国家的信函,要求其在AI竞赛中选边站队,明确支持华盛顿或北京。此举旨在强化对华技术遏制,可能重塑全球AI合作格局,加剧地缘政治分裂。How Hugging Face Inference Endpoints, Jobs, and Buckets Power Search on Papers with CodeHugging Face Blog2026-08-21T00:00:00Zhttps://huggingface.co/blog/pwc-search介绍Hugging Face推理端点、任务和存储桶如何支持Papers with Code的搜索功能,展示了其基础设施在学术资源检索中的应用。这体现了Hugging Face生态在AI研究和工程实践中的整合能力,有助于提升论文代码的可发现性。