多任务能力」共找到 7296 篇相关文章

算法论文8

不训练,解锁Agentic智能!微软:只需给LLM一台电脑

人大、MSR、清华的LLM - in - Sandbox开启「通用代理智能」新范式,把大模型放进“虚拟机”,让其在6大任务上成绩全线暴涨,零额外训练解锁“通用代理智能”,还介绍了相关实验、优化及效率情况。

PaperAgent
新闻资讯7

阶跃星辰豪揽超50亿融资,“天才创始人”印奇重掌帅印

阶跃星辰完成超50亿人民币B+轮融资,刷新近12个月中国大模型单笔融资纪录。同时印奇出任董事长。公司坚持“基础大模型”与“AI+终端”战略,在模态领域成果,正推进商业化探索。

InfoQ
开源动态8

医疗领域DeepSeek时刻:蚂蚁 · 安诊儿医疗大模型正式开源,登顶权威榜单

2026 年初,OpenAI 报告显示不少人用 ChatGPT 咨询医疗问题,还发布了 ChatGPT 健康。近日,蚂蚁集团等开源的蚂蚁・安诊儿医疗大模型或成最优解,它参数量大,在评测中登顶,技术优势明显。

机器之心
开源动态8

空间智能终极挑战MMSI-Video-Bench来了,顶级大模型全军覆没

上海人工智能实验室 InternRobotics 团队推出空间智能视频基准 MMSI-Video-Bench,对主流模态大模型进行评测。该基准题型全面、问题具挑战性,视频数据样,能针对性测评。结果显示模型与人类差距显著,明确了能力瓶颈。

机器之心
产品应用7

告别“云端依赖症”:AI为何要“锁”进本地硬件里?|甲子光年

过去三年,AI产业沉浸在云端幻象,但走进现实面临诸阻力,如物理距离、隐私、试错成本和监管等问题。下一阶段AI竞争转向算力位置争夺,英特尔酷睿Ultra系列处理器助力行业实现本地算力部署。

甲子光年
产品应用7

10人团队千万融资,这个原生AI产品要做“人人可用的数据Agent”丨对话ChatExcel

ChatExcel是国内首款原生AI DataAgent,专注自然语言对话处理分析数据。其不到10人团队获近千万融资,定位平民化数据产品,核心是模型结合,已近百万用户,正拓展海外市场。

量子位
推荐文章8

Anthropic官方解密:3招上下文优化,破解Agent性能暴跌

本文是Anthropic官方文章翻译,从提示词工程拓展到上下文工程,阐述其构建方法。介绍上下文工程对构建智能体的重要性、上下文构成,还提及上下文检索、智能体搜索及长期任务的上下文工程解决方案。

AI产品自由
新闻资讯8

OpenAI 3万亿美元测试,AI首战44个行业人类专家!

OpenAI推出GDPval评估体系,通过真实工作任务审视大模型潜力,揭示AI从实验室走向3万亿经济战场的可能。早期测试显示,Claude Opus 4.1表现最佳,GPT系列进步快,模型在部分任务逼近人类专家水平。

新智元
产品应用7

实测国内首个对话式AI音乐创作Agent:聊个天就能谱曲填词混剪生成MV

实测国内首个对话式AI音乐创作Agent Tunee,玩法像Suno+ChatGPT结合体。它操作简约功能全,能反复修改创作,还具备模态内容处理能力,虽有小瑕疵,但体现国产AIGC应用发展趋势。

量子位
算法论文8

AgentFly:重塑Agent,无需微调LLM,如我们一样的记忆和经验持续学习

现有LLM智能体依赖静态流程或微调参数,缺乏灵活性且成本高。论文提出基于记忆的在线强化学习框架AgentFly,不更新LLM权重,在基准测试表现出色,为构建通用智能体提供新范式。

深度学习自然语言处理