最新新闻条目(最近 10 条)
来自 2026-09-07 · 当日全部新闻
2026年上半年,智谱与MiniMax业绩相近:智谱收入9.54亿元,经调整净亏损19.64亿元;MiniMax收入1.17亿美元,经调整净亏损2.93亿美元。但截至9月4日,智谱市值约5000亿港元,MiniMax约1260亿港元,前者约为后者四倍。媒体分析认为,差异源于智谱聚焦Coding、商业路径清晰,而MiniMax两线作战、估值坐标模糊。
为什么重要该对比揭示资本市场对AI模型公司商业确定性的定价逻辑,影响投资者对同类公司的估值判断。
虎嗅
来自 2026-09-07 · 当日全部新闻
阿里巴巴研究部门发布 Qwen-Drive 1.0,一个同时处理空间感知、交通问答与路线规划的 AI 模型。该模型基于 Qwen3.5-4B 构建,通过两个附加模块实现 3D 地图构建与路径规划,旨在让同一模型既能驱动汽车又能充当座舱助手,同时避免灾难性遗忘。研究显示,纯文本-图像模型不会自动理解三维空间,需专门训练。在模拟器中,经强化学习重训后,车辆偏离道路率从 24% 降至 12%,但模型的解释有时与实际驾驶决策不符。
为什么重要该模型展示了通用大模型向具身智能与自动驾驶延伸的技术路径,对 AI 在汽车产业的应用及多模态模型能力边界有重要参考意义。
The Decoder
来自 2026-09-07 · 当日全部新闻
智谱AI发布GLM-5系列首个原生多模态模型GLM-5.3-Flash,总参数320B,仅18B激活参数,性能超越GLM-5.2,价格仅为后者的十分之一,在编码和智能体基准上接近Claude Opus 4.8。该模型采用稀疏与线性注意力混合架构,并引入流形约束超连接,显著降低长上下文服务成本。
为什么重要GLM-5.3-Flash以低成本实现高性能,可能加剧大模型价格竞争,并推动多模态与智能体应用的普及,对AI产业链的模型层及下游应用具有重要影响。
智谱 GLM 模型发布(HF) +1 家报道
来自 2026-09-07 · 当日全部新闻
英伟达在财报中介绍“本地AI计划”,为DeepSeek V4 Flash、阿里Qwen3.8等开源模型提供硬件优化,同时警告白宫限制中国AI将反噬自身业务。报道分析其商业逻辑与地缘逻辑的冲突,并援引CNAS与Forrester分析师观点,指出7月微软、Meta等20多家公司联名反对模型管制,凸显硅谷与华盛顿的分歧。
为什么重要该事件反映美国对华AI管制从芯片出口延伸至开源模型生态,直接影响英伟达等算力巨头的商业策略与全球AI产业链布局,对投资者理解政策风险与竞争格局具有参考价值。
虎嗅
来自 2026-09-07 · 当日全部新闻
腾讯发布并开源 EVIE-4.5B 视觉文档检索模型,基于 Qwen3.5-4B,采用单投影 Prefix-MRL 弹性多向量表示,支持运行时截断维度(64 至 2048 维),在 ViDoRe V3 基准上取得 66.02 的 nDCG@10 分数。模型通过 ARD 蒸馏自 8B 教师模型,并集成无需训练的 HAC 令牌压缩,将每页令牌数从约 750 压缩至 32 个,索引存储降至每百万页 3.81 GiB。
为什么重要该模型开源并展示高精度轻量级视觉文档检索能力,对 AI 产业中需要处理复杂文档(如表格、图表)的 RAG 应用和基础设施层有直接价值,可能推动视觉检索技术落地。
腾讯混元 模型发布(HF)
来自 2026-09-07 · 当日全部新闻
OpenAI研究员透露,GPT-6系列新模型Sol正在内部测试,其单次任务速度约为刚发布的Astra的六倍,但整体输出能力略逊。Sol使用约10万套NVIDIA Grace Blackwell NVLink72训练,未来还有40万套GPU上线。同日,OpenAI公布内部数据,称已达成“自动化AI研究实习生”目标,研究员人均每天有约3.1个Agent工作日并行,中位数研究员每日Agent推理资源花费超600美元。
为什么重要该消息揭示了OpenAI下一代模型在速度与推理深度上的分化路线,以及AI辅助研发对算力消耗的激增,对算力产业链和AI研发效率叙事具有重要信号意义。
量子位 QbitAI
来自 2026-09-07 · 当日全部新闻
9月2日,沙特AI公司HUMAIN发布旗舰模型HUMAIN M3,宣称“100%沙特模型”,但其428B总参数、23B激活参数的配置与MiniMax M3完全相同,引发质疑。发布者苏丹·阿尔法伊菲随后澄清,模型基于MiniMax M3开发。此事折射出中国开源模型正成为全球AI开发底座,此前日本乐天、新加坡AISG、马来西亚政府等均采用中国模型。
为什么重要该事件表明中国开源模型正从“卖API”转向“做底座”,其开放权重与低成本优势可能重塑全球AI产业链分工,对投资者理解中国AI企业的生态位与长期价值有参考意义。
虎嗅
来自 2026-09-07 · 当日全部新闻
2026年9月4日,OpenAI发布GPT-6 Astra,训练动用超10万块GPU。当日A股出现硬件跌停、应用涨停的分化,浪潮信息一字跌停,紫光股份跌7.5%,锐捷网络跌6.33%,三家合计蒸发超200亿元市值;四方精创等软件股涨停。但分析认为,软件上涨主因是工信部政策及跨境支付概念,GPT-6仅起情绪放大器作用。9月7日硬件反弹、软件回落,显示硬切软叙事仅维持一日,趋势确认仍需财报验证。
为什么重要该事件折射出市场对训练算力叙事见顶的担忧,以及推理算力与应用侧商业模式的重新定价,对AI产业链投资逻辑有重要参考意义。
钛媒体
来自 2026-09-07 · 当日全部新闻
Mostik团队在ARC-AGI 3基准上,让云端753B的GLM-5.2与手机端4B的Qwen-3.5通过“桥”协作,大模型只做预填充不输出文字,小模型负责解码输出,使4B模型弥补了与753B模型约50%的性能差距,自身准确率提升25%。团队含菲尔兹奖得主Stanislav Smirnov,技术细节尚未公开。
为什么重要该技术展示了大模型与小模型通过内部状态直接协作的潜力,可能降低推理成本并改变模型协作范式,对AI算力需求与模型部署策略有深远影响。
量子位 QbitAI
来自 2026-09-07 · 当日全部新闻
Mistral AI 发布 Mistral Small 4 的 NVFP4 量化版本(Mistral-Small-4-119B-2603-NVFP4),基于 119B 参数 MoE 架构(6.5B 激活),支持文本与图像输入,具备指令与推理双模式,上下文长度达 256k。该版本经后训练激活量化,由 vLLM 与 Red Hat 合作开发,采用 Apache 2.0 许可,可商用。相比 Mistral Small 3,在延迟优化设置下端到端完成时间减少 40%,吞吐优化下每秒请求数提升 3 倍。
为什么重要该模型作为开源 MoE 架构的代表,其量化版本与推理框架的深度优化,为 AI 应用层开发者提供了低成本、高吞吐的部署选项,可能影响模型即服务市场的竞争格局。
Mistral 模型发布(HF)
查看 模型 更早的历史新闻 →
关于 模型
AI 模型层是「五层蛋糕」里最受瞩目的一层——以 OpenAI、Anthropic、谷歌、DeepSeek 等为代表的大模型厂商,围绕 Transformer 架构与新兴的「推理模型」展开能力与成本竞赛。模型的开源 / 闭源路线、API 定价与算力依赖,深刻牵动上游芯片与下游应用。本页汇总 AI 模型层相关的中文精编,按时间倒序;同一事件多家来源已合并,每条标注来源、附原文链接,只做客观转述、不构成任何投资建议。