国产大模型
定义与起源
(待填写)
核心要义
(待填写)
在各文章中的应用
2026-06-16 2026-06-16:(Glance·看多)GLM-5.2在Fable停服窗口中获得替代叙事。 — GLM-5.2 被描述为支持1M上下文的国产Coding模型新高峰,叠加海外模型停服,国产模型可用性权重上升。 | 证伪:若真实代码任务无法替代高端闭源模型,国产替代窗口收窄。 2026-06-17 2026-06-17:(Glance·看多)MiniMax M3开源延续国产模型补位趋势。 — 海外模型可用性不稳后,MiniMax M3开源强化国产模型在Agent/Coding链条中的备份价值。 | 证伪:若真实Agent任务表现弱于预期,开源热度难转化为生产力。 2026-06-18 2026-06-18:(Glance·看多)GLM 5.2开源延续国产模型补位。 — GLM 5.2开源与前期MiniMax M3形成连续线索,海外模型可用性不稳时,国产/本地模型栈的重要性提升。 | 证伪:若真实Agent和Coding任务表现弱于闭源模型太多,开源热度难变成生产力。 2026-06-19 2026-06-19:(Glance·看多)GLM 5.2长上下文与复杂任务表现强化国产模型补位。 — GLM 5.2开源,稳定100万上下文;IndexShare使百万token下每token计算量下降约2.9倍。 | 证伪:若真实复杂任务和工具调用稳定性不足,国产模型补位价值受限。 2026-06-22 2026-06-22:(Glance·看多)模型精细管理阶段中国仍可追赶 — GLM5.2表现支持中国模型沿精细工程管理继续追赶美国。 | 证伪:若国产模型在Coding和长任务中持续落后且付费意愿下降,则追赶判断失效。 2026-06-22 2026-06-22:(Glance·看多)智谱验证国产前沿模型付费能力 — 宇十一从智谱付费和提价数据、培风客从模型精细工程管理切入,独立支持国产模型追赶;但技术收敛不等于二级市场赔率合理。 | 证伪:若国产模型Coding/长任务表现持续落后且开发者付费、MaaS ARR同时下降,则收敛判断失效。 2026-06-24 2026-06-24:(Glance·看多)Seed 2.1 Pro补齐Coding与Agent短板 — 卡兹克以30道办公任务测试,认为Seed 2.1 Pro的工具调用、长程任务和多模态办公已进入可用阶段。 | 证伪:若同一测试集的成功率、返工时间和成本持续落后头部模型,则可用性结论降权。 2026-06-24 2026-06-24:(Glance·看多)独立实测确认Seed可进入Agent工作流 — 歸藏用3个WebGL、3D和动效任务测试,认为Seed 2.1 Pro已能遵守Skills和工具约束完成复杂产物。 | 证伪:若API场景下工具调用错误率高或复杂任务稳定性不足,则独立验证不成立。 2026-06-25 2026-06-25:(Glance·看多)豆包日均Tokens调用量达180万亿 — 长安卫公摘录火山Force大会:豆包日均Tokens调用量180万亿,两年增长1500倍,公有MaaS Tokens份额49.5%,豆包2.1 Pro强化Coding/Agent/多模态。 | 证伪:若调用增长不能转化为付费续费和单位token毛利,或多模态生产级稳定性不足,则看多判断降权。 2026-06-29 2026-06-29:(Glance·看多)国民级App开始把能力封装为Skills/MCP — 卡兹克盘点16个App开放Skills/MCP/CLI,Agent从问答入口走向真实世界动作入口。 | 证伪:若支付、通讯录和交易动作长期无法开放闭环,则Agent生态价值受限。 2026-06-30 2026-06-30:(Glance·看多)DeepSeek新论文提升推理生成速度 — 长安卫公摘录DeepSeek DSpark在V4服务中较基线单用户生成速度提升约57%-85%。 | 证伪:若真实生产负载下吞吐、成本和稳定性不能复现,则性能改善降权。
思想演变
(待填写)
我的评估
(待填写)