腾讯预览了其7700亿参数的开源权重模型Hy4,该模型采用递归自改进循环技术,将自身推理吞吐量提升了31.8%。模型基于Apache 2.0许可发布,但API调用行为需开发者特别注意。这一技术突破表明AI模型正从被动训练向主动自我优化演进。报道时间2026年8月31日。
AI 资讯
每日精选 AI 行业动态,点开标题可直达原文出处。
每日精选 AI 行业动态,点开标题可直达原文出处。
腾讯预览了其7700亿参数的开源权重模型Hy4,该模型采用递归自改进循环技术,将自身推理吞吐量提升了31.8%。模型基于Apache 2.0许可发布,但API调用行为需开发者特别注意。这一技术突破表明AI模型正从被动训练向主动自我优化演进。报道时间2026年8月31日。
DeepSeek在HuggingFace上发布了V4-Flash-Vision-Exp实验性视觉模型,进一步扩展了其多模态能力。该模型延续了DeepSeek V4系列高效推理的定位,在视觉理解方向进行前沿探索。发布时间2026年9月1日。
阿里巴巴于8月26日发布了一款更小、更具成本效益的Qwen AI模型,进一步丰富其开源模型阵营。此前Qwen系列模型的全球下载量已突破30亿次,彰显中国开源AI的强劲势头(据Bloomberg报道,2026年8月26日)。
OpenAI将GPT-5.6 Sol模型的API价格下调50%,这是继此前GPT-5.4系列降价后的又一次大幅调价。该消息在Hacker News获得393分,引发广泛讨论。业界解读此举为应对DeepSeek V4 Pro和Anthropic Claude价格竞争的直接回应,标志着AI模型价格战进入新阶段。
阿里巴巴旗下开源AI模型Qwen在过去六个月内下载量突破30亿次,成功超越Meta的Llama系列和Google的Gemma系列,成为全球下载量最高的开源AI模型。据Digital Trends报道(2026年8月16日),Qwen已从中国本土模型成长为全球开发者不可或缺的工具,海外开发者采用率持续攀升。环球时报引述报告指出Qwen在多项基准测试中表现优异。
中国AI公司DeepSeek于8月14日正式发布其旗舰模型V4 Pro,并宣布自8月16日起实施全新的动态峰谷定价策略。据Android Headlines报道(2026年8月14日),虽然价格较此前上涨,但仍远低于西方同类模型。在Hacker News上,开发者展示了V4 Pro在完整100万token上下文窗口下实现207 tok/s的推理速度,且无需量化压缩。
Google于8月13日推出Gemini 3.7 Flash模型,作为其主力AI模型的最新版本。据VentureBeat报道(2026年8月13日),该模型将编程、Agent工作流和知识工作作为升级核心,同时提供50%的API入门价格优惠,旨在降低企业自动化成本并在编码和Agent任务上提供更强性能。
Meta于8月10日发布Muse Glimmer,这是一个30B参数的开源模型,采用Apache 2.0许可证,专为AI Agent场景优化。据VentureBeat报道(2026年8月10日),该模型支持原生视觉输入,围绕Agent循环进行端到端训练。同一天,Mark Zuckerberg在《卫报》发表6000字长文阐述「超级智能」愿景,强调开源AI对美国领导地位的重要性。
中国AI实验室智谱AI(Z.AI)于8月13日发布GLM-5.3模型,声称其在同等规模的开源模型中代码能力排名第一。据Decrypt报道(2026年8月13日),该模型在代码基准测试中击败了同等规模的开源模型,但仍落后于美国闭源前沿模型,标志着中国AI公司在开源代码模型领域的持续突破。
2026年8月10日,据VentureBeat报道。Meta发布了Muse Glimmer,一个拥有300亿参数的开源AI模型,采用Apache 2.0许可证。该模型专门针对AI Agent场景优化,支持原生视觉输入,并附带量化变体和推测解码加速器,标志着Meta在开源AI Agent领域的重大布局。
2026年8月14日,据SiliconANGLE报道。Anthropic发布最新AI风险报告,详细披露了尚未发布的Model 1和Model 2两个Claude后继模型相关信息。报告指出此前一次安全漏洞正是由一个未发布的LLM执行,提出了新的对齐担忧。
2026年8月14日,据Bloomberg和Z.ai官方博客报道,中国AI初创公司Z.ai(原智谱AI)发布了GLM-5.3,一款7530亿参数的开源大语言模型,旨在挑战Anthropic和OpenAI在编码领域的领先地位。该模型在Hacker News上获得323个赞和118条评论,其"涌现式网络能力"(emergent cyber capabilities)引起广泛关注。
2026年8月13日,据Ars Technica报道,Google发布了Gemini 3.7 Flash,距离上一代3.6 Flash仅三周时间。该模型在编码和文档处理基准测试上显著提升,Google声称其在商业工作流中超越Claude Sonnet 5和GPT。新模型推出50%的入门折扣,有效期至2026年12月31日。
2026年8月13日,据South China Morning Post报道,中国AI初创公司DeepSeek发布了V4 Pro模型的更新版本。虽然在整体基准测试中表现平平、令部分开发者失望,但在网络安全等细分领域展现出令人印象深刻的能力,体现了中国AI公司在特定垂直领域深耕的策略转变。
据Unite.AI报道,SpaceXAI(原xAI)于8月12日发布全新旗舰模型Grok 4.6,专为长时间运行的AI Agent及更复杂的交互与视觉任务设计。该模型在agent工作流中展现出更强的持久性和可靠性,标志着AI Agent从短任务向长周期自主运行迈出关键一步。
NVIDIA于8月11日正式发布其首个开源AI模型Nemotron 3.5 Lightning,企业可免费下载、修改和使用,无需向NVIDIA付费或获取许可。该模型定位为轻量级开源模型,专注于本地化AI代理应用。CEO黄仁勋表示,免费AI的普及反而会推动更多芯片需求,这标志着NVIDIA从纯硬件公司向AI软件生态布局的重要一步。(据CNBC报道,原文发表于2026年8月11日)
OpenAI 于 8 月 10 日推出 GPT-5.6-Cyber,在高级网络安全任务中完成率达 95%。同日宣布暂停 Astra 模型开发,因无法排除其具备关键级网络安全攻击能力。公司通过 Daybreak Red 访问层级向受信防御者分发该模型。(据 CNBC 和 VentureBeat 2026 年 8 月 10 日报道)
Meta 于 8 月 10 日发布 Muse Glimmer,一款 Apache 2.0 许可的 300 亿参数开源模型,专为 AI 代理任务优化,量化后可在消费级硬件上运行。CEO Mark Zuckerberg 同时发表宣言呼吁美国降低开源 AI 壁垒以与中国竞争。(据 The New York Times 2026 年 8 月 10 日报道)
据 VentureBeat 8月3日报道,阿里巴巴发布最大规模 AI 模型 Qwen3.8-Max,参数达 2.4 万亿,声称在智能体计算机使用任务上超越 GPT-5.6 Sol Max 和 Fable 5,可自主完成超 10 天软件项目。
阿里巴巴最新发布的Qwen3.8-Max模型在agentic computer use基准测试中展现出惊人能力,据称可自主完成超过10天的软件项目,并复现涉及数千行代码的研究论文。该模型拥有2.4万亿参数,采用开放权重策略,标志着中国AI在代理能力方面的重大突破。(据VentureBeat 2026年8月3日报道)