3.8 Flash 同级定价却逼近高价旗舰,靠"多推理步数"换准确率;Flash Cyber 安全能力前沿但仅限防御者,二者是同一底座被两套......
基于 Artificial Analysis 实测,Fable 5.1 在 max effort 下以 66 分登顶智能指数,但每任务成本较 Fable 5 高......
科技媒体The Information报道,全球越来越多AI实验室和开发者使用Mac训练和微调模型,苹果因此提前发布2026款Mac mini和Mac Stud......
SGLang Diffusion 团队在 8H200 上实测 MiniMax-H3 视频生成,密集无损路径较 Diffusers 快 1.85–1.95 倍,启......
实测 Qwen3.8 27B(27.3B 参数、混合注意力、262144 上下文、Apache 2.0)在 Mac Studio M3 Ultra 经 Olla......
8月31日界面新闻AI早报报道,研究显示AI公司每赚100美元收入,就有近40美元流向云服务商。这个数据揭示了AI行业的一个核心矛盾:AI公司在快速增长的同时,......
8月30日蓝鲸新闻报道,DeepSeek在V4 Pro正式版上线的同一份公告里给出了新价格,标志着中国大模型API价格从疯狂降价进入理性回调阶段。统计字节跳动、......
阿里宣称Qwen3.8-Flash以60亿激活参数超越Claude Opus 4.6。本文从基准测试、推理能力、代码生成、多轮对话、中文能力、成本效率六个维度进......
基于SemiAnalysis InferenceX公开基准的深度对比:OpenAI Jalapeño在每瓦工作量上达GB200/GB300的1.5-1.9倍,端......
2026年第30周大模型综合能力榜显示,Claude Opus 5(max)以60.7分登顶,Claude Fable 5(with fallback) 59.......
7月19日阿里发布Qwen3.8-Max-Preview,2.4T参数MoE架构,官方宣称“仅次于Fable 5”。实测基础编码扎实、全栈14文件一次跑通、Ag......
硅星人让Kimi K3、Qwen 3.8-Max和GLM 5.2共同改造一个堆满历史遗留代码的网站。六轮真实任务实测——项目分析、报错修复、轮播实现、样式修改、......