腾讯预览了其7700亿参数的开源权重模型Hy4,该模型采用递归自改进循环技术,将自身推理吞吐量提升了31.8%。模型基于Apache 2.0许可发布,但API调用行为需开发者特别注意。这一技术突破表明AI模型正从被动训练向主动自我优化演进。报道时间2026年8月31日。
AI 资讯
每日精选 AI 行业动态,点开标题可直达原文出处。
每日精选 AI 行业动态,点开标题可直达原文出处。
腾讯预览了其7700亿参数的开源权重模型Hy4,该模型采用递归自改进循环技术,将自身推理吞吐量提升了31.8%。模型基于Apache 2.0许可发布,但API调用行为需开发者特别注意。这一技术突破表明AI模型正从被动训练向主动自我优化演进。报道时间2026年8月31日。
DeepSeek在HuggingFace上发布了V4-Flash-Vision-Exp实验性视觉模型,进一步扩展了其多模态能力。该模型延续了DeepSeek V4系列高效推理的定位,在视觉理解方向进行前沿探索。发布时间2026年9月1日。
阿里巴巴于8月26日发布了一款更小、更具成本效益的Qwen AI模型,进一步丰富其开源模型阵营。此前Qwen系列模型的全球下载量已突破30亿次,彰显中国开源AI的强劲势头(据Bloomberg报道,2026年8月26日)。
阿里巴巴旗下开源AI模型Qwen在过去六个月内下载量突破30亿次,成功超越Meta的Llama系列和Google的Gemma系列,成为全球下载量最高的开源AI模型。据Digital Trends报道(2026年8月16日),Qwen已从中国本土模型成长为全球开发者不可或缺的工具,海外开发者采用率持续攀升。环球时报引述报告指出Qwen在多项基准测试中表现优异。
Meta于8月10日发布Muse Glimmer,这是一个30B参数的开源模型,采用Apache 2.0许可证,专为AI Agent场景优化。据VentureBeat报道(2026年8月10日),该模型支持原生视觉输入,围绕Agent循环进行端到端训练。同一天,Mark Zuckerberg在《卫报》发表6000字长文阐述「超级智能」愿景,强调开源AI对美国领导地位的重要性。
中国AI实验室智谱AI(Z.AI)于8月13日发布GLM-5.3模型,声称其在同等规模的开源模型中代码能力排名第一。据Decrypt报道(2026年8月13日),该模型在代码基准测试中击败了同等规模的开源模型,但仍落后于美国闭源前沿模型,标志着中国AI公司在开源代码模型领域的持续突破。
2026年8月10日,据VentureBeat报道。Meta发布了Muse Glimmer,一个拥有300亿参数的开源AI模型,采用Apache 2.0许可证。该模型专门针对AI Agent场景优化,支持原生视觉输入,并附带量化变体和推测解码加速器,标志着Meta在开源AI Agent领域的重大布局。
2026年8月14日,据Bloomberg和Z.ai官方博客报道,中国AI初创公司Z.ai(原智谱AI)发布了GLM-5.3,一款7530亿参数的开源大语言模型,旨在挑战Anthropic和OpenAI在编码领域的领先地位。该模型在Hacker News上获得323个赞和118条评论,其"涌现式网络能力"(emergent cyber capabilities)引起广泛关注。
NVIDIA于8月11日正式发布其首个开源AI模型Nemotron 3.5 Lightning,企业可免费下载、修改和使用,无需向NVIDIA付费或获取许可。该模型定位为轻量级开源模型,专注于本地化AI代理应用。CEO黄仁勋表示,免费AI的普及反而会推动更多芯片需求,这标志着NVIDIA从纯硬件公司向AI软件生态布局的重要一步。(据CNBC报道,原文发表于2026年8月11日)
Meta 于 8 月 10 日发布 Muse Glimmer,一款 Apache 2.0 许可的 300 亿参数开源模型,专为 AI 代理任务优化,量化后可在消费级硬件上运行。CEO Mark Zuckerberg 同时发表宣言呼吁美国降低开源 AI 壁垒以与中国竞争。(据 The New York Times 2026 年 8 月 10 日报道)
阿里巴巴最新发布的Qwen3.8-Max模型在agentic computer use基准测试中展现出惊人能力,据称可自主完成超过10天的软件项目,并复现涉及数千行代码的研究论文。该模型拥有2.4万亿参数,采用开放权重策略,标志着中国AI在代理能力方面的重大突破。(据VentureBeat 2026年8月3日报道)
阿里巴巴于2026年7月19日发布Qwen 3.8 Max预览版,参数量达2.4万亿(24 trillion),采用开放权重模式。阿里声称该模型性能仅次于Anthropic的Claude Fable 5,是全球第二强大的AI模型。消息公布后阿里巴巴港股上涨5.4%。据Firstpost和Seeking Alpha于2026年7月19日报道。
中国AI初创公司月之暗面(Moonshot AI)于7月17日发布最新前沿模型Kimi K3,在数学推理、代码生成和多语言理解等基准测试中表现出与Anthropic Claude Opus 4.8和OpenAI GPT-5.5相当的性能水平。Kimi K3作为开源权重模型,延续了中国AI公司在开源领域的竞争力,引发美国科技界广泛关注。
Scale AI创始人Alexandr Wang透露,Meta即将推出的Watermelon模型在关键AI基准测试上已追平OpenAI的GPT-5.5。Meta超级智能部门负责人确认该模型在多个维度达到旗舰水平,标志着开源阵营首次与闭源旗舰正面抗衡。据Insider于2026年7月2日报道。
据 Reuters 于2026年6月30日报道,中国外卖巨头美团正式发布并开源其下一代大语言模型 LongCat-2.0,参数规模达 1.6 万亿,是中国目前规模最大的 AI 模型。该模型完全在约 5 万张国产芯片集群上完成训练,未使用任何 Nvidia GPU,在多个编程和智能体基准测试中超越了 Google Gemini 3.1 Pro。模型采用 MIT 开源许可证发布,标志着中国在美国芯片出口管制下仍能推进前沿 AI 能力。
据VentureBeat于2026年6月12日报道,月之暗面(Moonshot AI)发布Kimi K2.7-Code代码模型,声称将推理token消耗减少30%并提供API无缝替换路径。但独立基准测试显示存在内核回归问题,且该模型未提交DeepSWE评测。从业者反映实际表现与官方宣传存在差距,凸显AI模型基准测试可信度问题。