自适应记忆建模」共找到 859 篇相关文章

算法论文8

Being-VL的视觉BPE路线:把「看」和「说」真正统一起来

北大、UC San Diego 和 BeingBeyond 联合提出 Being-VL 的视觉 BPE 路线,先将图像离散化并「分词」,再与文本统一建模,能缩短跨模态链路、保留视觉结构先验,还介绍了实现步骤、训练方式等。

机器之心
算法论文8

ICCV 2025 | RobustSplat: 解耦致密化与动态的抗瞬态3DGS三维重建

3DGS技术成研究热点,但现有方法在含动态物体场景建模精度不足。中山大学等研究者提出RobustSplat,有延迟高斯生长和尺度级联掩码引导两大核心设计,实验显示其在多指标上领先基线方法。

机器之心
算法论文8

ACL 2025 | AI字幕慢半拍,不知道大家在笑什么?新方法让同传性能直逼离线翻译

香港中文大学、字节跳动Seed和斯坦福大学团队提出SeqPO - SiMT框架解决同声传译“质量 - 延迟”权衡问题。该方法将同传建模为序贯决策过程,优化决策序列,实验显示其性能直逼离线翻译。

机器之心
开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
8

GPT-5.5 Instant上线:幻觉减少52.5%,告别废话

OpenAI完成ChatGPT默认模型的静默升级,GPT-5.5 Instant全面替换GPT-5.3 Instant。它在数学推理、减少幻觉、精简回答、记忆功能等方面有显著改进,还采用灰度推送策略。开发者认为其定位是日常场景够用顺手。

AI工程化
开源动态8

蚂蚁具身研究首次亮相!就解决了机器人「看」透明玻璃这些难题,还开源了

蚂蚁灵波科技开源高精度空间感知模型 LingBot-Depth,针对性解决机器人识别真实世界的「玻璃问题」。其构建双线并行数据集,提出掩码深度建模思路,在深度补全等任务中表现出色,且已具备落地能力。

机器之心
开源动态8

蚂蚁深夜开源比肩Genie 3的世界模型,我也看到了具身智能的未来。

蚂蚁旗下灵波科技凌晨开源世界模型LingBot-World,可对标Google Genie 3。它能实时交互生成世界,与视频生成模型不同。有三个版本,具备长时记忆稳定、风格泛化性强、动作代理出色等特点。

数字生命卡兹克
产品应用8

Macaron 新版本拆解:三个信号,看懂 Personal AI 的进化路径

Macaron新版本技术视频技术浓度超预期,结尾藏产品更新彩蛋。此次更新社交功能、Daily Spark、记忆打通等背后,藏着Personal AI关键变化,其团队Mind Lab有技术突破,开源方案获高认可。

特工宇宙
算法论文8

ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解

在大语言模型发展中,长文本建模挑战大。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。

机器之心
推荐文章7

我扒开Clawdbot的底层架构,简单到离谱,你看完就能自己写。

近期Clawdbot让科技圈震惊,作者花一下午分析其架构和源码后发现,它简单到看完文章就能自己写。它是电脑进程,消息处理分六步,记忆靠写文件,操作电脑有三类工具,无黑科技。

探索AGI