智能体闭环科研」共找到 3863 篇相关文章

开源动态8

The Batch: 859 | Qwen3 的自主智能新进展

不到两周前 Kimi K2 超越其他开源非推理模型,如今阿里巴巴发布基于早期 Qwen3 - 235B - A22B 的三款新大语言模型权重,介绍了输入输出规格、架构设计、性能表现、使用方式等,还进行了性能对比。

DeeplearningAI
推荐文章8

Harness is the New Dataset:模型智能提升的下一个关键方向

文章指出当基模能力成熟,决定 agent 上限的是围绕模型搭建的系统,即 harness engineering。介绍其组件、设计原则,探讨模型与 harness 关系,还列举创业机会项目,最后推测下一范式是 Coordination Engineering。

海外独角兽
推荐文章8

2026企业级智能体白皮书|甲子光年智库

随着大模型发展,人工智能从Chatbot转向Agent形态,OpenClaw等开源框架在消费级市场出色,但企业级应用需安全性、稳定性与管控边界。九科信息bit - Agent是企业AI进化“元枢纽”,白皮书为企业决策提供参考。

甲子光年
新闻资讯7

智能体崛起,AI+软件研发到新拐点了?

InfoQ《极客有约》X AICon 直播邀请多位嘉宾探讨 LLM 时代软件研发新范式。指出 AI 在测试中多为提效工具,距“原生开发时代”尚远;Coding Agent 潜力大;还谈及 AI 应用场景、落地问题、人员能力要求等。

AI前线
新闻资讯8

从 CIPS & CLM 迈进:中国大模型的智能跃迁

中国中文信息学会2025学术年会暨第二届中国大模型大会(CIPS & CLM 2025)于10月28日在北京召开,众多专家学者参会。大会聚焦大模型多方面内容,发布“大模型基金”,举办多场报告与论坛,展现中国AI领域进展。

AI科技评论
算法论文8

从「知题」到「知人」:UserRL让智能体学会「以人为本」

大语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。

机器之心
新闻资讯8

我国科研团队,突破了存算一体技术瓶颈

AI浪潮倒逼半导体产业创新,存算一体技术应运而生。但该技术应用存在问题,排序难题制约其发展。北大团队国际首次实现基于存算一体技术的高效排序硬件架构,成果发表在《自然∙电子》。

芯师爷
算法论文8

Auto-Research「终极大考」:新基准撕下大模型科研伪装

来自多所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。

机器之心
新闻资讯7

具身智能稀缺的数据,可能藏在这个游戏手柄里?

游戏录屏平台Medal掌握的玩家操作记录成机器人模型训练核心数据。其创始人皮姆创办General Intuition获高额融资,该公司用游戏录像预训练动作模型,但也面临数据多元性、任务表现及合作模式等问题。

DeepTech深科技
新闻资讯7

昨夜,Claude智能体压垮华尔街,近万亿刀市值蒸发

昨夜,Anthropic发布新一代AI工具「Claude Cowork」及11款职能插件,被视为AI向「独立员工」跨越的分水岭,动摇SaaS软件根基,引发华尔街恐慌,众多软件公司股票遭抛售。

机器之心