openPangu-2.0-Pro:华为505B开源模型
华为发布 openPangu-2.0-Pro——505B 参数 MoE 开源大模型,全程使用昇腾 910B NPU 训练。架构解析、算力主权意义、以及对性能声明的客观评估。
华为发布 openPangu-2.0-Pro——505B 参数 MoE 开源大模型,全程使用昇腾 910B NPU 训练。架构解析、算力主权意义、以及对性能声明的客观评估。
DeepSeek V4 Flash 0731 正式发布:Terminal-Bench 82.7、DeepSWE 54.4,9 项 Agent 基准全面超越 V4-Pro-Preview。284B/13B MoE 架构,1M 上下文,MIT 开源,$0.14/$0.28 每百万 token。
DeepSeek V4 以 MIT 许可、前沿模型零头的价格提供 1M token 上下文窗口。这个巨大窗口什么时候对 Agent 真有用,什么时候是陷阱。
Moonshot 的 Kimi K2.6 是为 Agent 而生的 1T 参数开源 MoE 模型。它真正擅长什么、万亿参数在哪有用在哪没用、以及怎么接进 Agent loop。
2026 年值得当 AI Agent 跑的开源权重 LLM 正面对决指南:Kimi K2.6、DeepSeek V4、GLM-5.1、Qwen 3.6。工具使用、上下文、编码还是成本,分别选谁。
Qwen 3.6 是阿里的开源 LLM,体量不大却在 SWE-bench 上越级打怪。为什么对 Agent 来说,一个更小更高效的模型常常是比巨型模型更聪明的默认。