注意力算法」共找到 756 篇相关文章

算法论文7

可解释性杀疯了!结合机器学习,发顶会轻轻松松!

在机器学习领域,模型可解释性愈发重要。结合XAI技术能提升模型透明度与可信度,如预测儿童饮食多样性、心血管疾病分类准确率很高。还整理9篇相关论文,解析两篇文章创新点、方法和结论。

机器学习AI算法工程
算法论文7

模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。

深度学习自然语言处理
产品应用8

天下苦CUDA久矣,又一国产方案上桌了

AI开发中,国产硬件增多,但开发者仍依赖进口生态。KernelCAT作为国产AI Agent应运而生,它能开发高性能算子,在昇腾芯片测试中表现出色,还能助力模型在国产平台高效迁移,限时免费内测。

量子位
算法论文8

机器人终于「懂」家务了!伯克利MomaGraph让机器人像人一样做家务

过去家用机器人做家务存在诸多难题,最近加州伯克利和马里兰大学联手推出 MomaGraph 技术。该技术采用「Graph - then - Plan」思路,团队搭建了完整体系,在星动 Q5 上测试效果好,让家用服务机器人迈向实用。

机器之心
新闻资讯8

AI教父Hinton首爆十年前拍卖:我早已内定谷歌必赢!

NeurIPS 2025访谈中,AI教父Hinton和Jeff Dean回顾AI发展。Hinton透露Scaling顿悟源于Ilya演讲,还谈及AlexNet、谷歌大脑诞生等。二人探讨Transformer、Gemini,也对AI未来发展方向发表看法。

新智元
算法论文8

一篇大模型Agentic框架到应用最新综述

这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。

PaperAgent
新闻资讯8

谷歌与OpenAI同获ICPC 2025金牌!GPT-5满分夺冠,Gemini攻破人类队伍都没解出的难题

ICPC是计算机程序设计领域的“奥林匹克”。今年GPT - 5满分、Gemini 2.5 Deep Think解10题,达金牌水准,超越人类强队,标志AI在算法竞赛“超车”,证明其具备临场推理等能力。

AI科技大本营
开源动态8

20000 GPU·h砸出 106 个SOTA模型架构:AI 科研进入“自我加速”时代

模型架构发现领域迎来突破,ASI - ARCH超级智能体无需人类预设搜索空间,完成科研闭环。经20000 GPU·h、1773次实验,发现106个超越人类SOTA的线性注意力架构,且已开源。

PaperAgent
产品应用8

揭秘夸克首个高考志愿大模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿大模型,上线‘高考深度搜索’等三大核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最大高考知识库,为考生提供精准志愿填报服务。

AI科技大本营
新闻资讯7

ChatGPT转型计划曝光!不再只是回答问题,而是通过穿插使用工具变身行动助手

OpenAI CPO Kevin Weil在访谈中透露,ChatGPT将从回答问题转变为为用户做事,通过穿插使用工具解决复杂问题。当下模型成本已是GPT - 4的500倍,未来将不断降低API价格,还提及模型效率突破关键等内容。

量子位