腾讯预览了其7700亿参数的开源权重模型Hy4,该模型采用递归自改进循环技术,将自身推理吞吐量提升了31.8%。模型基于Apache 2.0许可发布,但API调用行为需开发者特别注意。这一技术突破表明AI模型正从被动训练向主动自我优化演进。报道时间2026年8月31日。
AI 资讯
每日精选 AI 行业动态,点开标题可直达原文出处。
每日精选 AI 行业动态,点开标题可直达原文出处。
腾讯预览了其7700亿参数的开源权重模型Hy4,该模型采用递归自改进循环技术,将自身推理吞吐量提升了31.8%。模型基于Apache 2.0许可发布,但API调用行为需开发者特别注意。这一技术突破表明AI模型正从被动训练向主动自我优化演进。报道时间2026年8月31日。
DeepSeek在HuggingFace上发布了V4-Flash-Vision-Exp实验性视觉模型,进一步扩展了其多模态能力。该模型延续了DeepSeek V4系列高效推理的定位,在视觉理解方向进行前沿探索。发布时间2026年9月1日。
阿里巴巴于8月26日发布了一款更小、更具成本效益的Qwen AI模型,进一步丰富其开源模型阵营。此前Qwen系列模型的全球下载量已突破30亿次,彰显中国开源AI的强劲势头(据Bloomberg报道,2026年8月26日)。
OpenAI将GPT-5.6 Sol模型的API价格下调50%,这是继此前GPT-5.4系列降价后的又一次大幅调价。该消息在Hacker News获得393分,引发广泛讨论。业界解读此举为应对DeepSeek V4 Pro和Anthropic Claude价格竞争的直接回应,标志着AI模型价格战进入新阶段。
阿里巴巴旗下开源AI模型Qwen在过去六个月内下载量突破30亿次,成功超越Meta的Llama系列和Google的Gemma系列,成为全球下载量最高的开源AI模型。据Digital Trends报道(2026年8月16日),Qwen已从中国本土模型成长为全球开发者不可或缺的工具,海外开发者采用率持续攀升。环球时报引述报告指出Qwen在多项基准测试中表现优异。
中国AI公司DeepSeek于8月14日正式发布其旗舰模型V4 Pro,并宣布自8月16日起实施全新的动态峰谷定价策略。据Android Headlines报道(2026年8月14日),虽然价格较此前上涨,但仍远低于西方同类模型。在Hacker News上,开发者展示了V4 Pro在完整100万token上下文窗口下实现207 tok/s的推理速度,且无需量化压缩。
Google于8月13日推出Gemini 3.7 Flash模型,作为其主力AI模型的最新版本。据VentureBeat报道(2026年8月13日),该模型将编程、Agent工作流和知识工作作为升级核心,同时提供50%的API入门价格优惠,旨在降低企业自动化成本并在编码和Agent任务上提供更强性能。
Meta于8月10日发布Muse Glimmer,这是一个30B参数的开源模型,采用Apache 2.0许可证,专为AI Agent场景优化。据VentureBeat报道(2026年8月10日),该模型支持原生视觉输入,围绕Agent循环进行端到端训练。同一天,Mark Zuckerberg在《卫报》发表6000字长文阐述「超级智能」愿景,强调开源AI对美国领导地位的重要性。
中国AI实验室智谱AI(Z.AI)于8月13日发布GLM-5.3模型,声称其在同等规模的开源模型中代码能力排名第一。据Decrypt报道(2026年8月13日),该模型在代码基准测试中击败了同等规模的开源模型,但仍落后于美国闭源前沿模型,标志着中国AI公司在开源代码模型领域的持续突破。
2026年8月10日,据VentureBeat报道。Meta发布了Muse Glimmer,一个拥有300亿参数的开源AI模型,采用Apache 2.0许可证。该模型专门针对AI Agent场景优化,支持原生视觉输入,并附带量化变体和推测解码加速器,标志着Meta在开源AI Agent领域的重大布局。
2026年8月14日,据SiliconANGLE报道。Anthropic发布最新AI风险报告,详细披露了尚未发布的Model 1和Model 2两个Claude后继模型相关信息。报告指出此前一次安全漏洞正是由一个未发布的LLM执行,提出了新的对齐担忧。
2026年8月14日,据Bloomberg和Z.ai官方博客报道,中国AI初创公司Z.ai(原智谱AI)发布了GLM-5.3,一款7530亿参数的开源大语言模型,旨在挑战Anthropic和OpenAI在编码领域的领先地位。该模型在Hacker News上获得323个赞和118条评论,其"涌现式网络能力"(emergent cyber capabilities)引起广泛关注。
2026年8月13日,据Ars Technica报道,Google发布了Gemini 3.7 Flash,距离上一代3.6 Flash仅三周时间。该模型在编码和文档处理基准测试上显著提升,Google声称其在商业工作流中超越Claude Sonnet 5和GPT。新模型推出50%的入门折扣,有效期至2026年12月31日。
2026年8月13日,据South China Morning Post报道,中国AI初创公司DeepSeek发布了V4 Pro模型的更新版本。虽然在整体基准测试中表现平平、令部分开发者失望,但在网络安全等细分领域展现出令人印象深刻的能力,体现了中国AI公司在特定垂直领域深耕的策略转变。
据Unite.AI报道,SpaceXAI(原xAI)于8月12日发布全新旗舰模型Grok 4.6,专为长时间运行的AI Agent及更复杂的交互与视觉任务设计。该模型在agent工作流中展现出更强的持久性和可靠性,标志着AI Agent从短任务向长周期自主运行迈出关键一步。
NVIDIA于8月11日正式发布其首个开源AI模型Nemotron 3.5 Lightning,企业可免费下载、修改和使用,无需向NVIDIA付费或获取许可。该模型定位为轻量级开源模型,专注于本地化AI代理应用。CEO黄仁勋表示,免费AI的普及反而会推动更多芯片需求,这标志着NVIDIA从纯硬件公司向AI软件生态布局的重要一步。(据CNBC报道,原文发表于2026年8月11日)
OpenAI 于 8 月 10 日推出 GPT-5.6-Cyber,在高级网络安全任务中完成率达 95%。同日宣布暂停 Astra 模型开发,因无法排除其具备关键级网络安全攻击能力。公司通过 Daybreak Red 访问层级向受信防御者分发该模型。(据 CNBC 和 VentureBeat 2026 年 8 月 10 日报道)
Meta 于 8 月 10 日发布 Muse Glimmer,一款 Apache 2.0 许可的 300 亿参数开源模型,专为 AI 代理任务优化,量化后可在消费级硬件上运行。CEO Mark Zuckerberg 同时发表宣言呼吁美国降低开源 AI 壁垒以与中国竞争。(据 The New York Times 2026 年 8 月 10 日报道)
据 VentureBeat 8月3日报道,阿里巴巴发布最大规模 AI 模型 Qwen3.8-Max,参数达 2.4 万亿,声称在智能体计算机使用任务上超越 GPT-5.6 Sol Max 和 Fable 5,可自主完成超 10 天软件项目。
阿里巴巴最新发布的Qwen3.8-Max模型在agentic computer use基准测试中展现出惊人能力,据称可自主完成超过10天的软件项目,并复现涉及数千行代码的研究论文。该模型拥有2.4万亿参数,采用开放权重策略,标志着中国AI在代理能力方面的重大突破。(据VentureBeat 2026年8月3日报道)
据Reuters记者Eduardo Baptista报道,中国科技巨头阿里巴巴于8月3日发布其迄今为止最大、最强的AI模型,消息推动其港股股价飙升7%。这一发布与DeepSeek的低成本策略形成"大模型vs低成本"的双线竞争格局,标志着中国AI公司在模型规模竞赛中的持续加码。
Google于7月21日发布三款新AI模型。Gemini 3.6 Flash可在长周期工程任务中将AI Agent的token成本降低高达65%,同时发布的还有Gemini 3.5 Flash-Lite。此外,Google发布了首款网络安全专用AI模型Gemini 3.5 Flash Cyber,专注于漏洞发现、验证和修复,直接对标Anthropic的Claude Mythos安全模型。纽约时报同日报道了此次发布。(据VentureBeat、SDxCentral、NYT 7月21日报道)
据VentureBeat于7月24日报道,Anthropic正式发布Claude Opus 5,定位为日常主力模型。该模型在多项基准测试中接近旗舰Claude Fable 5的性能水平,但价格仅为后者的一半。针对编程、企业工作流和Agent任务深度优化,Anthropic将其描述为体贴且主动的模型。此次发布正值Anthropic筹备2026年IPO之际,价格策略意在抢占市场份额。
据VentureBeat于7月23日报道,微软正式发布自研AI模型Flash系列,据称相比使用OpenAI模型可降低高达89%的GPU成本。这些模型将用于Bing、Excel、Copilot和Dynamics等核心产品。CEO Satya Nadella强调Outlook等应用已开始将AI请求路由到自研MAI模型,而非OpenAI或Anthropic,标志着微软系统性降低对外部AI供应商的依赖。
中国AI公司月之暗面(Moonshot AI)发布Kimi K3,全球参数规模最大的开源AI模型,总参数量达2.8万亿。Kimi K3在多项前沿基准测试中与OpenAI和Anthropic的顶尖闭源模型性能相当。白宫高级官员指控月之暗面'蒸馏'Anthropic的Fable模型,并警告可能将其列入实体清单,引发中美AI技术竞争的新一轮升级。(据 Forbes 2026年7月17日报道)
Black Forest Labs于7月23日发布FLUX 3多模态前沿模型,支持图像生成和最长20秒的带音频视频生成。FLUX 3从静态图像延伸到视频,并特别强化了机器人手部等细节的生成质量,标志着AI生成媒体进入视频时代。(据 VentureBeat 2026年7月23日报道)
阿里巴巴于2026年7月19日发布Qwen 3.8 Max预览版,参数量达2.4万亿(24 trillion),采用开放权重模式。阿里声称该模型性能仅次于Anthropic的Claude Fable 5,是全球第二强大的AI模型。消息公布后阿里巴巴港股上涨5.4%。据Firstpost和Seeking Alpha于2026年7月19日报道。
中国AI初创公司月之暗面(Moonshot AI)于7月17日发布最新前沿模型Kimi K3,在数学推理、代码生成和多语言理解等基准测试中表现出与Anthropic Claude Opus 4.8和OpenAI GPT-5.5相当的性能水平。Kimi K3作为开源权重模型,延续了中国AI公司在开源领域的竞争力,引发美国科技界广泛关注。
OpenAI发布GPT-5.6版本,重点引入Work Agents(工作代理)功能,并推动桌面端应用的转型。新版本在自动化工作流程任务方面有显著提升,标志着OpenAI从单纯对话模型向企业级自动化工作代理的战略转变。
据Geeky Gadgets报道(2026年7月14日),Google因近期构建版本中编码性能表现不佳,决定推迟Gemini 3.5 Pro的发布计划。在GPT-5.6强势主导市场的背景下,Google选择暂缓发布以确保产品质量,反映出AI模型竞争已进入"质量优先"阶段。
据Geeky Gadgets报道(2026年7月13日),Anthropic下一代旗舰模型Claude Opus 5的泄露信息显示,其"Honeycomb"构建版本将支持高达100万token的上下文窗口。同时有报道称OpenAI已完成GPT-6的训练,超长上下文窗口正成为下一代模型竞争的核心维度。
据Computerworld报道(2026年7月9日),SpaceXAI发布Grok 4.5,基准测试显示每次编码任务成本约2.49美元,远低于GPT-5.5(5.07美元)和Claude Code中的Fable 5(11.80美元)。分析师指出实际企业测试仍是关键。
Google DeepMind决定取消原计划的Gemini 2.5 Pro基础模型,将旗舰模型Gemini 3.5 Pro的发布时间从6月推迟至7月17日,以增强数学推理能力。此次延迟反映了前沿AI模型发布前的质量把控日益严格。
Scale AI创始人Alexandr Wang透露,Meta即将推出的Watermelon模型在关键AI基准测试上已追平OpenAI的GPT-5.5。Meta超级智能部门负责人确认该模型在多个维度达到旗舰水平,标志着开源阵营首次与闭源旗舰正面抗衡。据Insider于2026年7月2日报道。
据 Reuters 于2026年6月30日报道,中国外卖巨头美团正式发布并开源其下一代大语言模型 LongCat-2.0,参数规模达 1.6 万亿,是中国目前规模最大的 AI 模型。该模型完全在约 5 万张国产芯片集群上完成训练,未使用任何 Nvidia GPU,在多个编程和智能体基准测试中超越了 Google Gemini 3.1 Pro。模型采用 MIT 开源许可证发布,标志着中国在美国芯片出口管制下仍能推进前沿 AI 能力。
据 9to5Mac 于2026年6月30日报道,Anthropic 已将 Claude 的默认中等规模模型从 Sonnet 4.6 升级为 Sonnet 5。新模型在编程、推理和多语言任务方面有显著提升,同时保持了与前代相同的定价策略。该升级面向所有 Claude 用户自动生效,进一步巩固了 Anthropic 在中等规模模型市场的竞争力。
Liquid AI 于2026年7月1日正式发布 LFM-2.5 230M 模型,这是一款专为移动设备、树莓派和机器人等资源受限场景优化的小型语言模型。该模型在极低参数量下展现了出色的推理能力,延续了 Liquid AI 高效架构的设计理念,进一步验证了小模型在边缘计算场景中的实用价值。
据VentureBeat 6月25日报道,Liquid AI发布其最小模型LFM2.5-230M,仅2.3亿参数,在结构化数据提取任务中表现优于参数量4倍于己的模型,可运行在任意设备上,证明了高效架构设计比单纯扩大参数规模更为重要。
日本AI初创公司Sakana AI于6月22日正式发布Fugu Ultra,一款高性能多智能体编排系统。据称在多项基准测试中超越了Anthropic的Fable 5和Mythos Preview模型,代表了AI系统设计从单一模型向多智能体编排演进的趋势。
字节跳动云计算部门于6月24日宣布,将于7月推出升级版AI视频生成模型。这是继中国AI视频生成赛道持续升温后的又一重要进展,进一步加剧了全球AI视频生成领域的竞争。
据开发者论坛泄露文档和预测市场数据,OpenAI计划于6月23日发布新一代旗舰语言模型GPT-5.6,首席科学家称其为有意义的飞跃。同期公司从Google DeepMind挖来Transformer共同发明人Noam Shazeer,为IPO前做最后冲刺。来源:MSN/TechTimes,2026年6月16日报道。
据Times of India和NewsBytes于2026年6月13日报道,Meta首席AI官Alexandr Wang公开承认公司此前的开源AI策略已不再适用于前沿模型。Muse Spark在早期训练中触发了生物安全风险检测后被转为闭源处理。Wang表示其他AI实验室也面临类似困境。这是Meta作为开源AI旗手(此前推出LLaMA系列)的首次重大战略倒退,暗示前沿AI模型的闭源趋势可能加速。
据Memeburn和9to5Mac于2026年6月11-13日报道,Apple在WWDC 2026上发布了第三代Foundation Models(AFM 3),一款拥有200亿参数的AI模型,可在iPhone上完全本地运行无需云端。Apple采用分层策略:端侧轻量级模型保障隐私,云端Private Cloud Compute处理复杂任务。开发者可通过LanguageModel协议在Apple模型、Gemini和Claude间无缝切换。
据VentureBeat于2026年6月12日报道,月之暗面(Moonshot AI)发布Kimi K2.7-Code代码模型,声称将推理token消耗减少30%并提供API无缝替换路径。但独立基准测试显示存在内核回归问题,且该模型未提交DeepSWE评测。从业者反映实际表现与官方宣传存在差距,凸显AI模型基准测试可信度问题。
据Digital Trends于2026年6月9日报道,Apple在WWDC 2026上发布了重大AI更新。iOS 27搭载全面升级的Siri AI,支持多轮对话和跨应用操作。Apple Intelligence框架大幅扩展,Foundation Models框架为开发者提供更强大的本地AI能力。这是Tim Cook作为CEO的最后一次主题演讲,也是Apple在AI竞赛中的关键转折点。
据VentureBeat于2026年6月1日报道,中国AI公司MiniMax推出M3模型,在关键基准测试中超越GPT-5.5和Gemini 3.1 Pro,而调用成本仅为后者的5-10%。M3展示了下一阶段AI代理开发将不仅由更大数据集驱动,更取决于高效的架构选择。这对追求性价比的企业用户尤其具有吸引力。
据TechCrunch于2026年6月9日报道,Apple在WWDC 2026上发布了全面重构的Siri AI,支持多轮对话、跨应用上下文理解和自主操作能力。Apple Intelligence获得重大升级,核心由Apple Foundation Models驱动,运行在私有云基础设施上,部分计算由Google TPU支持。同时发布iOS 27、macOS 27等全线系统更新,展示了业界最完整的端侧AI战略。
据 TechCrunch 于2026年6月9日报道,Apple 在 WWDC 2026 上发布了 Siri 的重大 AI 升级,支持多轮对话、屏幕感知和应用内操作。同时发布 iOS 27,强调性能优化。这也是 Tim Cook 作为 CEO 的最后一次主题演讲。Apple Intelligence 扩展至更多应用场景,包括空间重构(Spatial Reframing)等独特 AI 功能。
据TechCrunch记者Matthew Panzarino于2026年6月8日报道,Apple在WWDC 2026上发布了迄今最大规模的AI战略更新。全新Siri基于大语言模型深度重构,具备跨应用上下文理解和多步任务执行能力。iOS 27和macOS 27 Golden Gate均内置独立Siri AI应用,Apple Intelligence扩展至系统级智能写作、图像生成和智能摘要功能,标志着Apple正式全面入局AI助手竞争。
据 Geeky Gadgets 于2026年6月1日报道(引用 Universe of AI 的分析),OpenAI 的 GPT-5.6 模型预计将在2026年6月发布,在高级推理能力和智能体工作流方面带来显著提升。该版本着重增强了多步骤任务规划、工具调用和长期记忆能力,标志着 OpenAI 从"对话式 AI"向"自主执行式 AI"的战略转型。GPT-5.6 将与 Anthropic 的 Claude Opus 4.8 和 Google 的 Gemini 3.5 展开正面竞争。
仅显示最新 50 条,可使用右侧标签或时间筛选缩小范围