「检索任务」共找到 2166 篇相关文章
Kimi K2 详测|超强代码和Agent 能力!内附Claude Code邪修教程
作者熬夜带来 Kimi K2 模型详测及 CC+K2 邪修教程。K2 是 1T 参数量的 MoE 开源模型,基准测试成绩优异,在代码、Agent、数学推理任务表现突出,前端能力强,还能驱动 Claude Code,成本低。
8B模型可以超过GPT-4o!并行KV Cache压缩支持的128K长度外推方法ParallelComp
大模型长文本推理存在瓶颈,作者提出 ParallelComp 方案。它有并行 Attention 分块、KV 缓存智能淘汰与注意力偏差校准三大创新,能让 8B 模型性能达 GPT - 4o 的 91.17%,特定任务超 GPT - 4o。
英伟达港大联手革新视觉注意力机制!GSPN高分辨率生成加速超84倍
香港大学与英伟达联合推出广义空间传播网络(GSPN)。它采用二维线性传播与“稳定性 - 上下文条件”,将计算量降低,保留图像空间连贯性。在多视觉任务刷新性能纪录,如高分辨率生成加速超84倍。
超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光
英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。
击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判
理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒!
当全行业争论30B能否挑战万亿参数时,清华大学等联合研发的AgentCPM - Explore智能体模型用仅4B参数,在深度探索类任务有出色表现,且开源全流程配套工具,打破小模型性能局限。
用了飞书aily新功能,我终于理解什么叫“AI不是聊天,是干活”
作者黄叔体验飞书 aily 工作助手的“任务模式”后赞不绝口。该模式能异步工作、深度结合飞书生态,可像数字员工一样交付多种成果,如竞品报告、网页、海报、播客等,虽有不足但非常实用。
AI无师自通,搞定所有家务!π0.5突破泛化极限,UC伯克利系出品
具身智能最大挑战是泛化能力,美国具身智能公司Physical Intelligence推出π0.5 VLA模型,通过异构任务协同训练实现泛化,可在全新家中执行各种家务,虽有不足但向广泛泛化物理智能迈进。
硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。
文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。
刚刚,千问杀入汽车座舱!阿里不止做超级APP,更要做超级入口
阿里AI助手千问被接入红旗汽车智能座舱,这是通用AI助手首次以完整形态登陆车载场景。千问能完成复杂语义理解和任务规划,还将拓展至更多硬件,阿里要把它打造成AI时代超级入口。