「全自治智能体」共找到 4896 篇相关文章
独家|章鱼动力完成近5000万美元首轮融资,并发布SYNTH 深思架构
AI科技评论独家获悉,物理AI公司章鱼动力完成近5000万美元首轮融资,由地平线等联合投资。同时发布围绕操作智能、物理世界建模与数据体系协同的SYNTH深思架构,资金将用于研发等。
最强协作模型?MiniMax M2.7 实测:AI开始更会合作了 | Claude Teams
MiniMax M2.7模型发布,强调模型自我进化、Agent Harness和Agent Teams。它能构建复杂Agent Harness,完成高难度生产力任务。其能力达国际一线水平,在多测试中成绩优异。还介绍了Harness、Agent Teams等概念及应用场景。
比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一
昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。
刚刚,Karpathy紧急删库!AI职业末日图爆火,6000万白领岗危了
AI大神Karpathy上线项目复盘AI对就业的“侵蚀”程度,结果显示全行业平均暴露分高,约6000万个岗位高危,“屏幕依赖型”职业告急。该项目爆火后被删,哈佛论文指出AI引发职业重组。
阿里千问你别太荒谬!连漫画PPT都能一键生成?我以前那些夜真是白熬了
阿里千问发布AI PPT生成工具Qwen AI Slides,从内容结构到视觉配图全包。实测显示,其语义理解能力不错,文本渲染在简单字体表现好,排版有小瑕疵,适合课堂展示等场景。
清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026
在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。
挺意外的,Agent长期记忆潜力被AMemGym挖出来了
论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。
自动化评测的九九归一——评测agent
本文提出统一评测Agent架构,实现评测全链路自动化。它能学习标注标准,完成自动标注等工作。还介绍架构、解耦方法、模型优化及训练方案,解决多模态幻觉等问题,提升机审率,节省标注成本。
【AAAI 2026大会特邀报告】从推理到科学发现:AI迈向可精专通才之路
上海人工智能实验室周伯文在AAAI 2026大会提出,当前处于AGI前夕,需通专融合智能。他认为可深度专业化通用模型是实现AGI的可行路径,科学发现是AI前沿,还介绍了SAGE架构及相关成果。
告别RAG相似匹配!百度Agentic-R为多轮搜索重塑检索器
传统检索增强生成(RAG)有“单跳”局限,多跳推理易出错。人大高瓴与百度提出面向智能搜索的检索器训练框架 Agentic - R,采用双视角打分和双向飞轮模式,在多数据集上表现出色。