深度注意力」共找到 934 篇相关文章

算法论文8

微软研究院BioEmu登上Science,用生成式AI重塑蛋白质功能研究

7月10日,微软研究院AI for Science团队在《Science》发表成果,提出生成式深度学习模型BioEmu,结合多类数据训练,能模拟蛋白构象变化,有多项核心创新,已开源,未来将拓展应用场景。

机器之心
算法论文8

首次!世界模型、动作模型融合,全自回归模型WorldVLA来了

阿里巴巴达摩院提出全自回归模型 WorldVLA,首次融合世界模型与动作模型,统一文本、图片、动作理解和生成。它用独立编码器处理多模态数据,还提出策略解决误差累积问题,实验表现优异。

机器之心
算法论文8

只用2700万参数,这个推理模型超越了DeepSeek和Claude

Sapient Intelligence研究者受大脑机制启发提出分层推理模型(HRM),该模型仅2700万参数、1000个训练样本,就在复杂推理任务上超越DeepSeek和Claude等模型,还引入近似梯度等创新设计。

机器之心
新闻资讯7

苹果AI 路线图曝光:从未打算开发聊天机器人

苹果软件工程高级副总裁Craig Federighi在WWDC 2025表明,苹果从未打算开发聊天机器人,而是要将智能深度整合到所有平台体验中,实现环境智能,此言论引发网友热议。

AGI Hunt
新闻资讯7

吴恩达对谈LangChain创始人:企业构建Agen系统的核心认知!

吴恩达与LangChain联合创始人Harrison Chase深度对话,点明构建Agent系统关键要点,如关注系统‘Agentic’、解决构建核心挑战、模块化构建等,还提及被低估领域、MCP问题及AI创业制胜之道。

探索AGI
产品应用7

再见Bug!谷歌超级编码智能体Jules上线,免费使用直连GitHub

谷歌推出编程智能体Jules,进入全球测试阶段,有Google账户的开发者可免费试用每日5次。它基于Gemini 2.5 Pro模型,能写代码、修Bug等,还可连GitHub简化流程,预计今年晚些时候推更多功能和企业版。

新智元
算法论文7

模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。

深度学习自然语言处理
新闻资讯7

OpenAI官宣GPT-6 Astra,AGI时代要来了吗

OpenAI官宣GPT - 6 Astra,自称‘世界上最聪明、对齐最好的模型’,总裁称迎来AGI时代。它成绩亮眼,能直接完成工作,达网络安全阈值,训练让AI深度参与,但价格较贵。

CourseAI
产品应用7

AI办公工具实测红榜|打工人到底该留哪一款?

2026年AI办公赛道竞争焦点转向‘抢入口’,产品繁多让打工人选择困难。文章实测热门产品,分全能型、专项型、专业研究三类,横评各产品优势短板,还深度体验库库AI。

开源AI项目落地
新闻资讯8

斯坦福吴佳俊「计算机与思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026

8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机与思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力与物理模拟因果性,构建视觉与物理智能。

AI科技评论