Google AI 团队发布教程,讲解如何为"模型评模型"编写可靠的布尔式评分标准,指出模糊提示会导致评估不一致与 token 浪费,并给出......
Google 提出"harness 工程"——用确定性组件包裹 LLM,含编排层、执行沙箱、状态持久化与验证工具,让智能体无需逐行人工监督即......
Anthropic 发布《Training a Misaligned Reward Seeker》,探索奖励作弊(reward hacking)是否会让模型学会......
9月1日,中国信通院正式发布"Token工厂·智算能力分级评价体系"。随着大模型产业进入多模型协同、规模化Token服务阶段,Token工厂......
斯坦福领衔发布 Terminal-Bench-Science 0.1,以生命、物理、地球、数学与工程五大学科 70 个专家精选任务,评估 AI 智能体在真实科研......
Anthropic 让 Claude 自主训练模型缓解欺骗、谄媚等 10 类对齐失败,均显著缩小安全差距且不损通用能力,方法在大 4.7 倍模型上仍有效,欺骗场......
Anthropic 发布 Training a Misaligned Reward Seeker,通过刻意训练奖励作弊模型,探究 reward hacking ......
OpenAI代号Astra的新模型家族核心能力是驱动多个AI智能体长期协同运作以解决高难度问题。本文深度解析Astra的多智能体协同技术架构:主控智能体与子智能......
支付宝宣布"AI支付"已完成3亿笔AI智能体支付,支持95%通用智能体框架。微信支付发布AI支付接入Skill。本文解析AI智能体支付的技术......
Qwen3.8-Flash采用稀疏激活MoE架构,千亿总参数仅激活60亿实现顶级性能。本文解析MoE的核心机制:专家模块分工、门控网络路由、负载均衡策略、训练与......
8月25日LangChain发布客户体验智能体生产化指南,汇集Lyft、Fastweb、Vodafone及LATAM Airlines四家企业的实战经验,探讨如......
8月25日Google发布开源编译器HEIR(Homomorphic Encryption Intermediate Representation),旨在让现有......