长任务时代」共找到 3501 篇相关文章

算法论文7

Anthropic 新研究:AI出错是“热混乱”

Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。

AI工程化
新闻资讯8

Anthropic这两天真没闲着:上线网页版Claude Code,还让Claude搞科研

Anthropic推出Claude Code网页版,无需本地安装命令行工具,还提供Claude iOS应用预览版。其有并行处理多任务等亮点。此外,还发布Claude生命科学版,搭载Claude Sonnet 4.5模型,能助力科研。

AI前线
推荐文章7

从“铁三角”到“六有”组织,北银金科如何打造千人高密度数智化团队?| 极客时间企业版

在2025 DTDS全球数智人才发展大会上,北银金科赵瑞兰介绍数智化转型实践。北银金科构建“ACT”模型,打造“六有”组织文化,开发人力看板等成果,未来愿与伙伴探索AI时代

InfoQ
开源动态7

Agent 下半场:真正能自进化的 Agent 应该是什么样的?

当下 Work Agent 难以稳定完成复杂任务,且经验无法沉淀。EvoMap 提出自组织蜂群架构,通过 AutoResearch 落地验证,探索 AI4AI 方向,构建记忆和连接的三层产品结构,推动 Agent 网络自进化。

特工宇宙
产品应用7

Claude推出Agent View:一次管理所有编码会话

Anthropic为Claude Code新增Agent View功能,可集中管理编码会话,已开放研究预览。开发者操作路径清晰,早期用户总结出实用玩法,解决了常开多任务的切换难题,目前部分计划可体验。

AI工程化
开源动态8

多模态Deep Research,终于有了「可核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到可核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
新闻资讯8

数据中心不必建在地球!中国企业已经把算力设施送到了太空

国星宇航牵头“星算”计划,首发星座发射成功,将开启全球“太空计算时代”。太空部署算力可节约能源成本、及时处理数据且更安全,未来将与地面“天地协同”,中国在此领域走在前列。

量子位
产品应用8

中国造出一颗「不怕死」的AI大脑,专接最要命的活儿

全球首个搭载AI大脑的防爆机器人“若愚揽月01”接管加油站,其“若愚九天”机器人大脑深度整合多模块,采用双系统,实现“脑+体”合一,可迁移至多场景,成立三年成果显著,欲做机器人时代“智能内核”。

新智元
开源动态7

The Batch: 904 | 智能体全面释放

2025年11月开发者Peter Steinberger发布个人AI智能体OpenClaw,1月下旬在HackerNews提及后迅速走红。它可完成多种任务,有独特工作方式和架构,但也存在安全漏洞,引发AI社群讨论。

DeeplearningAI
算法论文8

AAAI 2026 Oral | 告别注意力与热传导!北大清华提出WaveFormer,首创波动方程建模视觉

北大清华团队在AAAI 2026 Oral论文中提出WaveFormer,首创用波动方程建模视觉。它将特征传播写成欠阻尼波动方程,实现频率 - 时间解耦,在多任务验证中速度、效率与精度全面超越。

机器之心