阿里巴巴旗下开源AI模型Qwen在过去六个月内下载量突破30亿次,成功超越Meta的Llama系列和Google的Gemma系列,成为全球下载量最高的开源AI模型。据Digital Trends报道(2026年8月16日),Qwen已从中国本土模型成长为全球开发者不可或缺的工具,海外开发者采用率持续攀升。环球时报引述报告指出Qwen在多项基准测试中表现优异。
AI 资讯
每日精选 AI 行业动态,点开标题可直达原文出处。
每日精选 AI 行业动态,点开标题可直达原文出处。
阿里巴巴旗下开源AI模型Qwen在过去六个月内下载量突破30亿次,成功超越Meta的Llama系列和Google的Gemma系列,成为全球下载量最高的开源AI模型。据Digital Trends报道(2026年8月16日),Qwen已从中国本土模型成长为全球开发者不可或缺的工具,海外开发者采用率持续攀升。环球时报引述报告指出Qwen在多项基准测试中表现优异。
中国AI公司DeepSeek于8月14日正式发布其旗舰模型V4 Pro,并宣布自8月16日起实施全新的动态峰谷定价策略。据Android Headlines报道(2026年8月14日),虽然价格较此前上涨,但仍远低于西方同类模型。在Hacker News上,开发者展示了V4 Pro在完整100万token上下文窗口下实现207 tok/s的推理速度,且无需量化压缩。
NVIDIA于8月11日正式发布其首个开源AI模型Nemotron 3.5 Lightning,企业可免费下载、修改和使用,无需向NVIDIA付费或获取许可。该模型定位为轻量级开源模型,专注于本地化AI代理应用。CEO黄仁勋表示,免费AI的普及反而会推动更多芯片需求,这标志着NVIDIA从纯硬件公司向AI软件生态布局的重要一步。(据CNBC报道,原文发表于2026年8月11日)
据 VentureBeat 8月3日报道,阿里巴巴发布最大规模 AI 模型 Qwen3.8-Max,参数达 2.4 万亿,声称在智能体计算机使用任务上超越 GPT-5.6 Sol Max 和 Fable 5,可自主完成超 10 天软件项目。
腾讯于2026年8月6日将其开源大语言模型 Hy3 推向国际市场。该模型专为推理、编程、指令遵循和 AI 智能体应用设计,展示了中国科技企业在开源 AI 领域的全球扩张战略,标志着中国开源大模型出海进入新阶段。(据 Gulf Business 报道)
据Reuters记者Eduardo Baptista报道,中国科技巨头阿里巴巴于8月3日发布其迄今为止最大、最强的AI模型,消息推动其港股股价飙升7%。这一发布与DeepSeek的低成本策略形成"大模型vs低成本"的双线竞争格局,标志着中国AI公司在模型规模竞赛中的持续加码。
Google DeepMind于7月21日发布三款新Gemini模型:3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。其中3.6 Flash在长周期工程任务上将AI Agent的token成本降低高达65%,在Arena AI排行榜首次亮相即位列第12名。但旗舰Gemini 3.5 Pro因代码生成性能不达标而继续延迟,Google同时透露正在训练Gemini 4。
阿里巴巴于2026年7月19日发布Qwen 3.8 Max预览版,参数量达2.4万亿(24 trillion),采用开放权重模式。阿里声称该模型性能仅次于Anthropic的Claude Fable 5,是全球第二强大的AI模型。消息公布后阿里巴巴港股上涨5.4%。据Firstpost和Seeking Alpha于2026年7月19日报道。
中国AI初创公司月之暗面(Moonshot AI)于7月17日发布最新前沿模型Kimi K3,在数学推理、代码生成和多语言理解等基准测试中表现出与Anthropic Claude Opus 4.8和OpenAI GPT-5.5相当的性能水平。Kimi K3作为开源权重模型,延续了中国AI公司在开源领域的竞争力,引发美国科技界广泛关注。
中国AI初创公司Moonshot AI于7月16日正式发布Kimi K3,这是一个拥有2.8万亿参数的开源大语言模型,是目前全球最大的开源权重模型。据VentureBeat报道,K3在多项前沿基准测试中与OpenAI的GPT-5.5和Anthropic的Claude Opus 4.8不相上下。该模型已在Hugging Face上以Apache 2.0许可发布。
据MacRumors、CNBC和BeInCrypto综合报道(2026年7月1日-2日),Anthropic于7月1日恢复Claude Fable 5和Mythos 5全球访问权限,美国商务部正式解除出口管制。但恢复后的Fable 5 BridgeBench评分大幅下降,用户称其被'过度阉割'。Anthropic同时推出了Claude Science科研专用模型。
据 Reuters 于2026年6月30日报道,中国外卖巨头美团正式发布并开源其下一代大语言模型 LongCat-2.0,参数规模达 1.6 万亿,是中国目前规模最大的 AI 模型。该模型完全在约 5 万张国产芯片集群上完成训练,未使用任何 Nvidia GPU,在多个编程和智能体基准测试中超越了 Google Gemini 3.1 Pro。模型采用 MIT 开源许可证发布,标志着中国在美国芯片出口管制下仍能推进前沿 AI 能力。
在被SpaceX以600亿美元收购后,Cursor宣布正从零开始在xAI的Colossus超级计算机上训练一个1.5万亿参数的前沿模型,同时推出GitHub竞品Origin。6月29日正式发布iOS应用,开发者可通过手机管理AI编码代理。(据Tech Times和9to5Mac报道,2026年6月24-29日)
中国AI公司智谱AI于6月13日发布GLM-5.2模型,在全球AI评测中排名第四,得分51分,超越了Google Gemini。据《朝鲜日报》报道,这标志着中国AI模型在全球竞争中的又一重要里程碑,展示了中国AI力量的持续崛起。
据开发者论坛泄露文档和预测市场数据,OpenAI计划于6月23日发布新一代旗舰语言模型GPT-5.6,首席科学家称其为有意义的飞跃。同期公司从Google DeepMind挖来Transformer共同发明人Noam Shazeer,为IPO前做最后冲刺。来源:MSN/TechTimes,2026年6月16日报道。