公众号 公众号二维码 扫码关注公众号 AI工具导航 投稿
登录 注册 退出

标签:MoE架构

共 8 篇文章
阿里发布Qwen3.8-Flash并开源:千亿参数仅激活60亿,训练成本骤降90%创效率新基准 AI

阿里发布Qwen3.8-Flash并开源:千亿参数仅激活60亿,训练成本骤降90%创效率新基准

8月26日晚阿里发布并同步开源千问最新模型Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿即可获得超越Claude Opus4.6的......

普思 1个月前 9 阅读
微信自研大模型WeLM正式公布:80B已跑在小微上,617B MoE正在路上 AI

微信自研大模型WeLM正式公布:80B已跑在小微上,617B MoE正在路上

8月13日,腾讯微信团队正式公布自研大语言模型WeLM系列。WeLM-80B(800亿参数/30亿激活)已部署于微信原生AI助手“小微”;WeLM-617B(6......

普思AI资讯 1个月前 15 阅读
DeepSeek-V4-Flash正式版上线:130亿激活参数,把Agent能力拉到逼近旗舰 AI

DeepSeek-V4-Flash正式版上线:130亿激活参数,把Agent能力拉到逼近旗舰

7月31日,DeepSeek-V4-Flash正式版API上线公测。总参数2840亿、激活130亿,在Terminal Bench 2.1等九项Agent基准测......

普思AI资讯 1个月前 12 阅读