「代理能力」共找到 3355 篇相关文章
TRAE SOLO 模式中国版惊艳上线,重新定义 AI 编程
字节 TRAE 推出 SOLO 模式解决复杂编程任务难题,11 月 25 日国内版上线且免费。它体验增强,集成 SOLO Coder,有执行前方案评审等四个关键能力,带来新协作模式,提升编程效率。
重磅!微软宣布开源Copilot!用 5000 万用户直接碾压 Cursor和Windsurf?
在 Build 2025 开发者大会上,微软宣布 GitHub Copilot Extension for VSCode 项目开源,还发布全新 AI 编码代理。开源是多因素推动的深思熟虑之举,预示 AI 开发工具从‘黑盒’向‘共建’转变。
吴恩达:图灵测试不够用了,我会设计一个AGI专用版
AI大神吴恩达2026年要做新的图灵-AGI测试,弥补AGI定义无统一标准、现有基准测试易误导大众的空白。该测试聚焦AGI经济性和实际产出,能更好衡量AI通用能力。
AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?
Anthropic 公布全新 Skills 功能,让开发者可通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明可审计,受开发者称赞。
IEEE TPAMI 2025 | 北京大学提出分布驱动的终身学习范式,用结构建模解决灾难性遗忘
北京大学周嘉欢与彭宇新教授合作在 IEEE TPAMI 发布研究成果 DKP++,针对终身学习的灾难性遗忘问题,提出分布建模引导的框架,增强历史知识记忆与跨域学习能力,代码已开源。
美7000万人或被取代,Agent光速卷入职场!北大校友、杨笛一新作
斯坦福大学研究团队调查104个职业领域1500名专家及52名AI研究员,构建WORKBank数据库。研究发现职场AI需求与能力错配,工人对AI态度不一,还揭示未来人类技能变化趋势。
让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方
上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。
多模态模型挑战北京杭州地铁图!o3成绩显著,但跟人类有差距
近年来,多模态大模型在多种场景取得进展,但能否‘看懂图’存疑。西湖大学等团队提出评测基准ReasonMap,评估模型在地铁图理解中的能力,发现主流模型有瓶颈,闭源模型虽优但仍逊于人类。
Claude后台接管电脑,真·赛博替身!人机并行时代来了
Anthropic宣布全面升级Claude「计算机使用」能力,操作可在后台完成。该功能处于Beta测试,已向Claude Pro和Max订阅的macOS用户开放。Claude此次更新覆盖多场景,人机并行时代或来临。
英伟达开源上瘾了!推出了一款实时语音智能体的终极 ASR:24ms 极速锁定。
英伟达开源了Nemotron Speech ASR模型,它是低延迟、实时流式语音识别模型,单句转录锁定仅需24毫秒。其核心能力包括缓存感知、运行效率高、动态运行灵活,还被放进完整语音智能体方案。