长上下文任务」共找到 2881 篇相关文章

产品应用8

迎接智能体的「觉醒时刻」:EverOS全球公测开启Agent Memory自进化序章

随着主动执行型 Agent 爆发,AI 向自我演化智能体跃迁,但现有 Agent 有诸多痛点。EverMind 团队公测专为自我演化智能体设计的记忆底座 EverOS,它依托核心算法与进化引擎,提升任务成功率,解决多项技术难题。

机器之心
算法论文8

港大×复旦×上交:视触觉融合+闭环纠错,让机器人双臂协作不再「盲操」

港大联合复旦、上交大提出TAMEn,在UMI框架上全方位升级,构建视触感知融合等数据闭环,打通数据采集到再训练链路。其三层闭环让机器人学得更快准高效,在双臂协作任务中提升成功率。

量子位
开源动态8

突然,被GLM-4.7的Coding交付能力惊到了

国内大模型圈因智谱启动A股上市而兴奋时,GLM系列再展“卷王”姿态,本月开源旗舰GLM - 4.7。它从代码大模型变为任务交付引擎,实测在多场景表现出色,能理解复杂意图、交付高质量代码。

PaperAgent
产品应用8

Granola 为什么能赢:会议笔记,把产品做简单很重要

Granola是新推出一年多的AI笔记产品,迅速成硅谷创业者、投资人常用工具。其创始人认为,“AI笔记”头号竞争对手是苹果备忘录。产品好用关键在于极简“蜥蜴脑设计”与利用用户“上下文”,文中还分享设计思考与实用经验。

Founder Park
算法论文8

大模型再爆弱点!旧记忆忘不掉,新记忆分不出,准确率暴降 | ICML'25

弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。

新智元
算法论文8

The Batch:841 | 大语言模型正在纠正历史遗留的不公

美国北加州旧不动产契约含种族歧视条款,虽已非法但人工筛查耗时久。斯坦福和普林斯顿研究团队微调大语言模型识别圣克拉拉县契约中的歧视条款,模型可理解上下文,结果经律师确认,研究成果已开源。

DeeplearningAI
新闻资讯8

OpenAI 黑科技 Deep Research 诞生记:一个工程师的“不务正业”如何改变 AI 战争格局

OpenAI宣布美国用户可免费使用集成于ChatGPT的AI研究助手Deep Research。OpenAI负责人分享其背后故事,探讨起源、人类专家数据作用等,还提及RFT时机、代理安全性等,并展望其能访问私有数据,适用于具体任务

AI前线
推荐文章7

智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队

如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。

AI前线
算法论文8

解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体

浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优化方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。

AI科技评论
算法论文7

八年后,Meta教会了Transformer「显式思考」

10月20日Meta上线新论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer新架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。

机器之心