空间稀疏注意力机制」共找到 761 篇相关文章

产品应用8

Tabbit浏览器实测:AI终于学会帮我上网干活了

本文实测Tabbit浏览器,它刚正式发布且免费。与Arc、Atlas不同,Tabbit切换成本几乎为零,有智能标签整理、妙招功能、Agent智能代理等,还内置多个国内外大模型,但脚本妙招和智能标签整理有改进空间

花叔
新闻资讯7

具身导航:感知推理是上帝,还是执行控制是命门?| GAIR Live 023期预告

具身导航正从‘几何避障’向‘空间智能’跨越,当前领域经历范式变革。GAIR Live 023期线上圆桌将聚焦其前沿进展与落地问题,邀请两位专家拆解底层逻辑,还给出了核心议题、讨论精华预览及参与方式。

AI科技评论
产品应用7

谷歌发布 Gemma Scope 2,深化对 LLM 行为的理解

Gemma Scope 2 是谷歌推出的解释 Gemini 3 模型行为的工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先的 Gemma Scope,还引入针对聊天机器人的分析工具,已发布权重。

InfoQ
开源动态8

给Agent装上“海马体”!上海AILab开源MemVerse,定义多模态记忆新范式

上海人工智能实验室开源MemVerse,这是首个面向智能体的通用多模态记忆框架。它将多模态信息与文本对齐到统一语义空间,首创‘双通路’架构与‘记忆蒸馏’技术,让智能体有终身记忆能力,在多模态任务中表现出色。

量子位
新闻资讯7

对谈零次方闵宇恒,我们应该怎么教本科生去创业?|00后创业者系列

本文是对00后创业者闵宇恒的访谈。他25岁清华硕士在读,本科毕业一年带领具身智能团队获亿元级融资。文中介绍其创业经历、零次方机器人特色,探讨大学创业教育、具身智能发展等问题。

AI科技评论
新闻资讯7

马斯克的作业还是被奥特曼「抄走了」

奥特曼宣布几周内发布ChatGPT新版本,12月推成人模式,让其重获个性化“灵魂”。这似在抄马斯克Grok作业,背后是为AI产品增长,当下AI之战已演变成争夺用户注意力和多巴胺的战争。

新智元
新闻资讯7

先验+后验加持,大模型能否 hold 住推理预测的现实「溢出」?

多数大模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,大模型在现实场景运用仍待优化。

机器之心
新闻资讯7

Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention

这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。

Founder Park
算法论文8

英伟达再出手!新型混合架构模型问世,两大创新实现53.6倍吞吐提速

英伟达研究者提出新混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 两大创新。

机器之心
算法论文8

模型遗忘不代表记忆抹除!首次系统发现「可逆性遗忘」背后规律

研究人员发现大语言模型遗忘并非简单信息删除,可能藏于内部。他们构建表示空间诊断工具,区分可逆与不可逆遗忘,揭示真正遗忘是结构抹除。还在多种方法、数据集和模型上实证,得出系列结论。

新智元