领域特定任务」共找到 3673 篇相关文章

新闻资讯8

感知、控制与数据:ICRA 2026 中国企业报告的三个交汇点

ICRA 2026期间,速腾聚创等六家中国企业分享机器人领域进展。他们关注感知底层基础、接触‘最后一毫米’问题、数据与模型关系,且技术路径和产品侧重有差异,具身智能注重工程落地和系统能力建设。

AI科技评论
算法论文8

ICML 2026 | Agentic强化学习训练的信息自锁问题

随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。

机器之心
算法论文7

从OpenAI AI Phone到Gemini on Android:AI手机时代需要怎样的Agent Harness?

过去一年,AI与手机关系被重新定义,腾讯混元等机构研究PhoneHarness,关注AI在手机上行动及任务完成验证问题。它让手机Agent行动不止GUI,还有Bench检验执行结果,推进AI手机基础设施建设。

机器之心
新闻资讯7

Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想

新智元报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。

新智元
新闻资讯8

帮大家总结了一下凌晨的Google I/O 2026开发者大会。

本文总结Google I/O 2026开发者大会成果,涵盖AI模型、产品、Agent系统、视觉生成、搜索、电商等多领域。如推出Gemini 3.5 Flash,升级产品功能,发布新Agent系统,推进电商协议,还有科研成果与硬件更新。

数字生命卡兹克
新闻资讯7

极客部落 OPC 入驻路演评审,首批AI创业共建者加速集结

5月8日,极客部落OPC入驻路演评审活动举办,旨在筛选首批入驻团队。活动邀请多部门代表评审,路演项目覆盖多领域,采用多维度评分机制,后续将确定入驻名单,极客部落会持续支持AI创业者。

AI前线
新闻资讯7

大模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流大模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化
产品应用8

AI学会梦里干活!Claude发布3大进化,Dario:单人公司10亿美金爆发

在 Code with Claude 大会上,Anthropic 为 Claude Managed Agents 上线三项功能。‘做梦’解决记忆退化,成果评估自动检查工作,多 Agent 协作让复杂任务分工处理。Dario 称 AI 时代单人公司或达 10 亿美金营收。

鲸选AI
新闻资讯7

全球电池回收技术爆发:中国专利断层式领先,宁德时代子公司排第一

欧洲专利局和国际能源署报告显示,全球电池回收技术创新爆发,循环利用专利增长快。中国在该领域表现突出,宁德时代子公司邦普循环专利领先,且中国掌控矿产精炼与回收两端,不过全球面临缺料挑战。

DeepTech深科技
产品应用7

养了只东北味熊猫当AI合伙人,一口一个老铁,还真帮我开了家「一人公司」

腾讯ima上线copilot模式,可“领养”小熊猫并设定人设风格,成专属知识伙伴。它不分对话和任务模式,知识库功能实用,还能私人定制。作者用它模拟创业,体验良好,其记忆和全场景感知实用。

量子位