新能安」共找到 7785 篇相关文章

开源动态8

具身智体不再失忆!智源记忆系统让机器人秒变熟人,支持终身记忆

智源研究院等联合提出全终身记忆系统RoboBrain-Memory,是全球首个为全双工、全模态模型设计的系统。它解决具身智体交互问题,实现类人长期个性化交互,在多方面表现优异,有广泛应用前景。

量子位
开源动态8

Github 斩获 16.3k star,Open Lovable 只需1分钟,就克隆你的任意网站!

Open Lovable 是 Firecrawl 团队开源项目,通过 AI 聊天将任意网站转化为 React 应用,支持整站抓取与重组。它解决了多类人群痛点,功丰富,技术架构有优势,在同类对比中表现出色,获 16.3k star。

小华同学ai
开源动态8

KTransformers入选计算机系统顶会、与主流框架合作,趋境&清华让「异构」成为推理范式

KTransformers由趋境科技与清华团队联合研发,是高性异构推理框架。其论文入选SOSP 2025,还与SGLang合作。它有算子优化等创让CPU与GPU协同,推动推理架构融合,已成广泛复用的底层框架。

量子位
开源动态8

十年来Python生态最好工具,引爆全社区的uv到底是什么?

uv是用Rust写的Python包和项目管理工具,被天文学家Emily L. Hunt博士赞为近十年Python生态最好的事。它功强大,替代多个工具,速度快,兼容性强,装简单,还轻松管理项目。

机器之心
算法论文8

让机器人「不仅会想,还准确去做」,VLA-R1把「推理+行动」带进真实世界

VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它有两阶段训练、三类可验证奖励等创点,经多层面测试效果好,在多领域有应用前景。

机器之心
算法论文8

ACMMM 2025 | 北大团队提出 InteractMove:3D场景中人与可移动物体交互动作生成框架

北大团队在ACMMM 2025发布InteractMove,首次提出含可移动物体3D场景中基于文本的人 - 物交互生成任务,构建数据集与创框架,在多指标领先,代码与模型已开源。

机器之心
算法论文8

首次实现第一视角视频与人体动作同步生成!框架攻克视角-动作对齐两大技术壁垒

加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创设计解决核心难题,实验性超基线,为多领域应用提供落地基座。

量子位
算法论文7

多模态推理基准!最强Gemini 2.5 Pro仅得60分,复旦港中文上海AILab等出品

现有多模态大模型benchmark对逻辑推理理解不足,复旦大学等单位提出MME - Reasoning评估其推理力。对30 + 模型评测,最优得分仅60%左右,反映出模型多方面推理短板。

量子位
产品应用7

一分钟做3D音符版“跳一跳”,Flowith成通用Agent“必玩王者”丨TIP 003

Flowith作为较早出海的AI产品,以自由画布+通用Agent组合出圈。其Neo版本技术功强,产品服务有亮点,如不限DeepResearch任务、以人为主的智代理、回答速度快等,虽有不足但未来值得关注。

鲸选AI
开源动态8

CVPR 2026 | 1B模型也当多镜头导演?大连理工&快手可灵开源力作MultiShotMaster

大连理工与快手可灵团队推出MultiShotMaster框架,在1B左右小参数量级模型实现导演级镜头调度和连贯叙事,支持多图参考、主体运动控制。论文录用至CVPR 2026,代码已开源,还获AAAI CVM Workshop竞赛冠军。

机器之心