「注意力改造」共找到 273 篇相关文章
VGGT4D:无需训练,挖掘3D基础模型潜力,实现4D动态场景重建
香港科技大学(广州)与地平线研究团队提出 VGGT4D,无需训练,通过挖掘 Visual Geometry Transformer 注意力层运动线索,在动态物体分割等任务表现优异,为 4D 重建提供新思路。
Rust 天花板级大神公开发帖找工作:3000 次核心提交,不敌 “会调 OpenAI API、用 Cursor”?
Rust 编译器核心贡献者 Nicholas Nethercote 和 Michael Goulet 因团队缩编等原因公开找工作。Nicholas 称 AI 吸走大量资金与注意力,使 Rust 项目资源减少。同时,Unix 联合创始人质疑 Rust 能否取代 C。
Skywork技术论坛一手分享:Agent与多模态的落地真相|甲子光年
8月19日,昆仑万维发起第一期Skywork全球技术论坛讨论会,众多高校和企业嘉宾围绕Agent与多模态展开交流。探讨了Agent商业化、多模态应用等核心问题,提出诸多判断,指出行业热度高但落地是关键。
告别评估乱象!首个视觉解释综合性基准发布,附人类真值 | KDD'25
埃默里大学团队推出首个视觉解释基准Saliency - Bench,构建8个任务的数据集,提供标准化评估流程与开源工具包,解决评估缺乏标准等问题,推动可解释AI向可靠、透明发展。
揭秘 GitHub 11.1k 让你的存储秒变“万能盘”?JuiceFS:最好用的存储系统能为你带来怎样革命性的提升?
云存储成本高、性能差等问题让人烦恼,JuiceFS 可零代码改造,将对象存储升级为高速共享文件系统。它功能丰富、架构有优势,代码示例简单,适用于多场景,相比竞品优势明显。
冷战核废墟变8吉瓦AI超级工厂!黄仁勋押15亿,OpenAI独霸20年
英伟达、OpenAI和软银要将美国俄亥俄州冷战核废墟改造成全球最大AI超级工厂,终极电力规划达8吉瓦。黄仁勋宣布注资、担保,OpenAI签长约,孙正义改造电网,这或成稳赚买卖。
Claude神之bug:给自己下指令,还诬赖用户??Hacker News炸了
强如Claude也现诸多bug,如分不清发言角色,把恶意注入指令当用户请求。技术根源是Transformer架构注意力机制盲区。网友给出避坑方案,还吐槽Claude算力调整、计费乌龙等问题。
华为新架构砍了Transformer大动脉!任意模型推理能力原地飙升
即便Transformer是AI世界基石,但遇到复杂数学题或多步逻辑推理时表现不佳。问题出在Attention机制。华为诺亚方舟实验室推出Nexus高阶注意力机制架构,能提升模型推理能力,且参数零增。
AI越来越强大,如果客户都去自研了,那企业软件市场会怎么样?
AI能力变强、门槛降低,引发企业软件开发是否会被颠覆的讨论。企业不会自建核心系统,因要专注核心业务且不想承担维护等成本。真正威胁是用AI重新设计产品的同行,技术更替规律下传统SaaS公司需警惕。
更长的推理链反而导致更多幻觉,MLLMs 幻觉解法仅「抄作业」还不够?摘要
近日,斯坦福等校学者发现,更长推理链会让 MLLMs 产生更强幻觉。MLLMs 幻觉不仅涉及语言偏差,还有跨模态语义失配。主流多模态架构在结构设计和训练机制上的潜在失衡,是幻觉频发的主因。