member-avatar观奕行研财经/商业/AI/Web3
是否省力要看和谁比。与671B传统架构的大模型相比,moe无疑是节省资源的。但若和实际消耗同等显存的大模型相比,moe模型的运行效率相对会更低

来自文章:DeepSeek算力需求暴降,为什么全球算力竞赛反而更疯狂了?

2025-02-21