长期记忆基准」共找到 1564 篇相关文章

算法论文8

Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
开源动态8

哔哩哔哩献给二次元世界的礼物—AniSora,目前最强大的开源动漫视频生成模型

动画视频生成评估挑战大,现有模型处理动画视频力不从心。哔哩哔哩推出AniSora综合系统,支持一键生成多种动漫风格视频镜头,在角色和动作表现上出色,在多维度超越当前先进模型。

带你学AI
8

浙大开源HugAgentOS:三引擎一体自进化,每步可归因/回放/回滚

过去一年,Agent任务执行能力提升,但不会自主积累与进化。浙大开源的HugAgentOS把Harness拆成三个可自我成长的引擎,设归因和本体两道关卡,解决经验成能力等问题,还覆盖智能体完整链路。

新智元
新闻资讯7

OpenAI挖来了个F1级别车手搞公关

OpenAI花半年找到CMO Colin Fleming。他经验丰富,曾在Salesforce、ServiceNow任职,擅长让市场理解新技术。OpenAI营销长期缺失,他的到来是弥补的一部分,但公关主管仍空缺。

量子位
开源动态7

乐鑫开源首个「物联网设备Agent框架」,Claw的风终于吹到硬件上

乐鑫开源首个物联网设备Agent框架ESP - Claw,用C语言重写。它核心理念是对话即创作,可让用户通过聊天定义硬件行为。具备运行效率高、内存占用低等特点,还有多种功能及良好的生态适配性。

开源AI项目落地
算法论文8

机器人学会“脑补”触感,叠衣服端茶水成功率暴涨90%

近年来,人形机器人研发从行走转向复杂操控,但处理精细家务表现逊色。卡内基梅隆大学联合博世人工智能中心团队提出 HTD 模型,让机器人预判触觉,在 5 项任务上成功率提升 90.9%,部分代码开源。

DeepTech深科技
产品应用8

腾讯大模型动作慢了吗?姚顺雨带着Hy3 preview杀进第一梯队

国内大模型发展迅速,腾讯此前动作较慢。姚顺雨加入后推动变革,混元团队重建推出Hy3 preview,有295B总参数和快慢思考融合架构,开源且性能优,在多方面表现出色,成本下降。

AIGC开放社区
产品应用8

跨维智能DexWorldModel斩获榜首,世界模型真正的考场在机器人执行里

今年4月,Generalist AI发布GEN - 1,其CEO表示不再将模型归类为VLA。当下VLA和世界模型是具身智能主流技术路线,多数世界模型在机器人任务上有瓶颈。跨维智能DexWorldModel在RoboTwin榜单表现出色,还开源EmbodiChain助力行业。

量子位
开源动态8

让AI自动构建AI模型:UCSD 推出 AIBuildAI 智能体,斩获OpenAI MLE-Bench榜单第一

近日,加州大学圣地亚哥分校研究团队开发 AIBuildAI 智能体,可全自动构建 AI 模型。它在 OpenAI MLE - Bench 基准测试 75 个任务上以 63.1% 获奖率居榜首,实现端到端自动化。

机器之心
推荐文章8

当数据库的主要用户不再是人类:我们在 AI Agent 场景下的架构实践与思考

文章分享了服务 AI 公司时在 Agent 场景下数据库架构的实践与思考。介绍 Agent 工作负载特征,通过三个案例说明数据库面临的挑战及解法,还提到新需求催生开源项目 mem9,并给出实践教训,指出 AI 时代数据基建重要性。

InfoQ