核心认知基准」共找到 2722 篇相关文章

开源动态8

不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍

英伟达联合多机构推出TTT - E2E方法,在长文本处理上提速显著且性能不打折。它基于标准Transformer,将长文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。

量子位
产品应用7

用户痛点发现器

用户痛点发现器是个Web应用,能从社交媒体自动发现用户核心痛点,支持聚类分析和AI产品方案生成。它可输入关键词抓取抖音视频和评论,用GLM-4.6模型分析,还有优先级评分等系统。

GitHubStore
新闻资讯7

苹果重磅官宣谷歌Gemini 将支持 Siri,OpenAI 被边缘化?马斯克比奥特曼还急:这不合理!

苹果和谷歌达成多年合作协议,下一代 Apple Foundation Models 将基于谷歌 Gemini 模型及云技术构建,为 Siri 等功能提供核心支持。此合作引发行业讨论,马斯克质疑权力集中,也影响了 OpenAI 在苹果生态的角色。

AI前线
产品应用8

CES深思考:没做人形机器人的石头,如何抢占家庭具身智能第一入口?|甲子光年

2026年CES上,石头科技推出全球首款能扫楼梯的轮足扫地机器人G - Rover,它重新定义空间维度,可在台阶稳定作业。石头科技以场景需求定义形态,研发围绕用户需求,在全球市场表现出色。

甲子光年
算法论文8

刚刚,智元提出SOP,让VLA模型在真实世界实现可扩展的在线进化

智元具身研究中心提出SOP框架,可让VLA模型在真实世界实现可扩展的在线进化。它是颠覆性的机器人学习新范式,整合在线、分布式和多任务机制,构建闭环打破机器人认知时间边界。实验显示其性能优越。

机器之心
新闻资讯7

智能体的记忆管理机制及其潜在风险 | 直播预约

大语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能的影响及潜在风险,展示缓解关键挑战的策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。

深度学习自然语言处理
开源动态8

VLNVerse“宇宙降临”:吴琦团队交出2025具身导航最终答卷

自2018年吴琦团队发表首篇VLN论文后,领域碎片化问题凸显。2025年末其推出全栈平台VLNVerse,涵盖场景生成、物理模拟、任务基准和通用模型,欲打通Real2Sim2Real,推动VLN向Embodied VLN跨越。

AI科技评论
推荐文章8

破除AI Agent自主操控风险:万字解读LangGraph“人工干预”机制 ,附零基础实战

随着LLM驱动的Agent从学术走向应用,确保其行为的可靠性、安全性与可控性成关键挑战。文章以LangGraph为例,介绍其人工干预机制的核心原理、四大经典模式及案例实践,助开发者构建可靠、安全的智能代理。

腾讯技术工程
开源动态8

低调霸榜全球最难SQL榜单超两月,国产AI这次选择高调开源!

蚂蚁数科低调霸榜全球最权威SQL榜单超两月后高调开源Agentar - SQL系列。其核心思想是让AI赋能生产,在金融场景验证后能力外溢到多领域,还采用按效果付费模式,展现强大竞争力。

量子位
算法论文8

谷歌发布智能体Scaling Law:180组实验打破传统炼金术

谷歌新论文通过180组实验找到智能体的Scaling Law(定量扩展原则),在四个基准测试评估,推导预测模型,实验结果颠覆直觉,还量化阻碍因素,发现不同模型协作性格,为智能体部署决策提供支撑。

机器之心