「任务完成时间视野」共找到 2977 篇相关文章
OpenAI内部大重组!模型行为团队并入Post Training,负责人另起炉灶
OpenAI对模型行为团队重组,其创始负责人Joanne Jang组建OAI Labs,探索人与AI协作新范式。模型行为团队约14人并入Post Training,OpenAI还完成系列人事调整。
一站式机器人操作控制框架ManiUniCon
ManiUniCon是多进程机器人控制框架,为操作任务设计。有模块化设计、多机器人支持等特性,介绍了架构、支持的硬件、安装方法、使用方式、开发途径及可用工具等内容。
DeepSeek大招曝光?梁文峰督战超级智能体:能自主学习,或年底发布
据彭博社爆料,DeepSeek正开发AI智能体,打造无需复杂指令、可自主学习与执行的下一代AI系统,年底发布。此前DeepSeek R1表现出色,曾推动开源发展,此次新动作彰显竞争决心。
杜克大学、Zoom推出LiveMCP‑101:GPT‑5表现最佳但未破60%,闭源模型Token效率对数规律引关注
杜克大学与Zoom研究者推出LiveMCP - 101,这是针对真实动态环境的MCP - enabled Agent评测基准。含101个任务,实验显示先进模型成功率低于60%,研究为提升Agent能力提供改进方向。
陈丹琦有了个公司邮箱,北大翁荔同款
清华姚班校友、普林斯顿教授陈丹琦被曝与Thinking Machines有关联,团队主页有其名字,其GitHub邮箱也以该公司后缀结尾。若属实,这将是她涉足工业界首站。该公司虽无产品,但人才资本丰厚。
刚刚,清华团队用27M参数击败o3-mini!或将改变AI发展方向
清华大学研究团队发布论文,展示Hierarchical Reasoning Model(HRM)。该模型仅27M参数、1000个训练样本,在推理任务上击败OpenAI的o3 - mini - high,或改变AI发展方向。
The Batch: 855 | 为智能体而生
总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。
首篇潜空间推理综述!模型思考不必依赖Token,带宽暴增2700+倍
史上首篇潜空间推理综述全面总结新兴推理范式,分析循环、递归等推理形式并总结成框架。潜空间推理用潜式思维链,带宽比显式CoT提升2700多倍,还介绍无限深度推理实现途径。
用MoE打造DNA基础模型更强范式!人大实现seq2func全新突破
中国人民大学团队提出SPACE模型,通过引入物种感知编码器和谱系分组增强解码器,革新架构,提升了DNA基础模型性能与泛化能力,在多项测试中表现优于主流模型。
仅10行代码,轻松打通你的AI应用与DB:谷歌开源数据库MCP,Star突破4.6k
谷歌开源面向数据库的MCP Toolbox,位于应用编排框架和数据库间,处理连接池等复杂问题,简化工具管理。它能助开发者构建让智能体访问数据库的Gen AI工具,有开发简便等优势。