「指标证据链」共找到 668 篇相关文章
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。
鼠标点3下就能锁定打击?五角大楼曝光美军AI大脑
美国国防部首席数字与人工智能官Cameron Stanley演示Maven系统,将美军杀伤链从小时压缩到分钟。Maven整合多系统,Palantir的AIP嵌入大模型改变战争决策逻辑。Anthropic因坚守安全红线与五角大楼冲突。
关于Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti的理解
文章分析Nsight Compute中Compute Workload Analysis反映的Tensor Pipe Uti异常现象。通过实验和推算,发现ncu对L20 GPU上特定指令用错误执行延迟算指标,导致异常,还给出GEMM Kernel性能分析建议。
【万字长文】Anthropic发布Prompt Engineering全新指南
Anthropic发布全新Prompt Engineering指南,涵盖元提示、模板等关键技术。介绍了prompt类型、必备要素,还给出优化技巧,如添加示例、思维链精炼等,涉及XML标签、链式提示等方法,也提及减少幻觉、提高一致性等内容。
The Batch:836 | 基准测试成本攀升
独立AI测试实验室披露评估推理模型成本上升。这些模型生成“思维链”提升输出质量,但计算需求增加,成本上升使资源有限组织难复现结果,且新模型定价、按需分配推理token也让成本更复杂。
“同事.skill”不用写了,爱马仕 Hermes 主动“蒸馏”你,还让开发者集体抛弃 “龙虾”?!
近日,Hermes Agent 在国内爆火,获超 3.9 万 stars。它是单 Agent 架构,核心是学习循环,记忆分层管理。其网关功能强大,状态可跨会话留存。背后的 Nous Research 目标是打造抗衡 OpenAI 的开源模型,还引入区块链解决算力问题。
智谱发布GLM 4.5,不仅开源模型还把训练框架也开源了
智谱AI发布GLM 4.5,不仅开源模型,还开源整套后训练基础设施。模型规格亮眼,性能也超越qwen 235b。其开源的训练框架slime专为强化学习扩展设计,完整工具链支持多种模型。
Anthropic 发布最新研究:LLM 展现初步自省迹象
Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。
清华天眸芯团队再登Nature系列期刊封面,类脑互补视觉范式重塑AI感知世界的方式
清华天眸芯团队继2024年《Nature》封面后,最新进展又登《Nature Sensors》封面。此次研究实现系统级算法软件生态飞跃,还开源工具链。成果在多场景有应用潜力,晰见科技推动其产业化。
库克留给苹果新CEO“第一份作业”
2026年9月1日,约翰·特努斯将接替库克任苹果CEO。届时可折叠iPhone将亮相,苹果未来产品线涵盖约10个新品类,均以AI为核心,但特努斯需解决Siri及供应链等问题。