虎嗅APP
虎嗅APP
公众号矩阵
公众号矩阵
加入社群
加入社群
我要投稿
我要投稿
资讯
24小时
源流
视频
活动/榜单/专题
妙投
虎嗅智库
虎嗅嗅全新升级
虎嗅嗅全新升级
加入黑名单
观奕行研
财经/商业/AI/Web3
关注
Ta的文章
Ta的24小时
Ta的消息
Ta的评论
Ta的收藏
Ta的关注
Ta的订单
黑名单
是否省力要看和谁比。与671B传统架构的大模型相比,moe无疑是节省资源的。但若和实际消耗同等显存的大模型相比,moe模型的运行效率相对会更低
来自文章:
DeepSeek算力需求暴降,为什么全球算力竞赛反而更疯狂了?
2025-02-21
来自文章:DeepSeek算力需求暴降,为什么全球算力竞赛反而更疯狂了?