你现在的位置是:当前位置: 首页 >


为什么Qwen模型总给我一种又土又low的感觉?

更新时间:2025-06-26 18:30:16

本来用下来对Qwen3印象不太好,但30B A3B这个惊呆了,台式机265k用cpu跑都有30多的速度,得益于Moe架构,每次只激活3b参数,压力很低,可用度非常高。

虽然经常吐槽qwen模型思考链又臭又长来刷分,但也是对比deepseek 671b版来说的,但只看开源小模型,32b模型它家之前qwq 包括这次的qwen3 32b和30b没啥好挑的了。

为什么Qwen模型总给我一种又土又low的感觉?

案例推荐

case recommendation
  • 为何 Linus 一个人就能写出这么强的系统,中国却做不出来?

    查看案例

  • Go 语言 Web 应用开发框架,Iris、Gin、Echo,哪一个更适合大型项目?

    查看案例

  • 为什么在中国,一间「看起来没什么用」的房间最终都会被装修成书房?

    查看案例

  • 为什么游戏中,中国跟欧洲的时延这么大,是否是海底光缆距离过长的原因?

    查看案例

  • 媒体称以色列防空成本一晚近 3 亿美元,最多再撑 12 天,美方会支援吗?若无美补给结果会如何?

    查看案例

  • go为了编译速度减少了很多编译优化?为什么不能提供优化编译模式来提升运行效率?是太懒还是另有隐情?

    查看案例

  • Golang与Rust哪个语言会是今后的主流?

    查看案例

  • 伊朗警告以色列居民尽快撤离,称将展开真正惩罚性打击,伊朗还有哪些底牌?以伊冲突会演变为中东全面战争吗?

    查看案例