公众号 公众号二维码 扫码关注公众号 AI工具导航 投稿
登录 注册 退出

标签:Qwen

共 8 篇文章
Qwen3.8-Flash vs Claude Opus 4.6深度对比:60亿激活参数能否真正超越千亿密集模型 AI

Qwen3.8-Flash vs Claude Opus 4.6深度对比:60亿激活参数能否真正超越千亿密集模型

阿里宣称Qwen3.8-Flash以60亿激活参数超越Claude Opus 4.6。本文从基准测试、推理能力、代码生成、多轮对话、中文能力、成本效率六个维度进......

普思 2小时前 0 阅读
Qwen3.8-Flash架构深度解析:千亿参数仅激活60亿的MoE效率革命是如何实现的 AI

Qwen3.8-Flash架构深度解析:千亿参数仅激活60亿的MoE效率革命是如何实现的

Qwen3.8-Flash采用稀疏激活MoE架构,千亿总参数仅激活60亿实现顶级性能。本文解析MoE的核心机制:专家模块分工、门控网络路由、负载均衡策略、训练与......

普思 2小时前 1 阅读
阿里发布Qwen3.8-Flash并开源:千亿参数仅激活60亿,训练成本骤降90%创效率新基准 AI

阿里发布Qwen3.8-Flash并开源:千亿参数仅激活60亿,训练成本骤降90%创效率新基准

8月26日晚阿里发布并同步开源千问最新模型Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿即可获得超越Claude Opus4.6的......

普思 2小时前 2 阅读