openPangu-2.0-Pro:华为505B开源模型
华为发布 openPangu-2.0-Pro——505B 参数 MoE 开源大模型,全程使用昇腾 910B NPU 训练。架构解析、算力主权意义、以及对性能声明的客观评估。
华为发布 openPangu-2.0-Pro——505B 参数 MoE 开源大模型,全程使用昇腾 910B NPU 训练。架构解析、算力主权意义、以及对性能声明的客观评估。
DeepSeek V4 Flash 0731 正式发布:Terminal-Bench 82.7、DeepSWE 54.4,9 项 Agent 基准全面超越 V4-Pro-Preview。284B/13B MoE 架构,1M 上下文,MIT 开源,$0.14/$0.28 每百万 token。
Qwen 3.8 Max 是阿里巴巴 2.4 万亿参数多模态旗舰模型,支持 1M 上下文、MoE 架构,Arena.AI 排名第二。本文详解规格、定价及 SandBase 接入方式。