好表现定义」共找到 3237 篇相关文章

推荐文章8

给野马套上缰绳:Agent Harness 工程实践 ——从范式理论到钉钉AI招聘的真实落地

本文围绕 Agent Harness 工程实践展开,指出瓶颈在‘装’模型而非模型本身。介绍 Agent 公式、范式跃迁、四条铁律、工程模式,以悟空 AI 招聘为例说明落地,还分析行业标杆、未来趋势,给出心法。

阿里云开发者
开源动态8

Agent不会搞科研?人大微软开源框架&工具包解决盲目试错通病,抱抱脸日榜第一

AI智能体虽能完成多项任务,但大多难以自主科研,易陷入盲目试错。人大和微软研究者提出Arbor框架与工具包,借助Hypothesis - Tree对优化空间结构化探索,多方面表现出色,荣登Huggingface日榜第一。

量子位
算法论文8

端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统

北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。

机器之心
算法论文8

Transformer已死?DeepMind正在押注另一条AGI路线

谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。

新智元
产品应用8

告别复杂提示词!蚂蚁新方式让AI自动理解你的个性化需求

蚂蚁通用人工智能研究中心自然语言处理实验室提出AlignXplore方法,通过强化学习让AI从用户行为归纳偏并动态更新。该方法训练分两阶段,支持流式偏推断,实验表现优异,是大模型个性化新尝试。

量子位
开源动态8

60000小时炼出新开源VLA!20多种机器人都能用

蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。

量子位
算法论文8

ICML 2026 | 突破3DGS光度多义性瓶颈:北航/新国立提出AmbiSuR,重塑高保真3D几何重建

3D高斯泼溅推动神经渲染发展,但提取3D几何表面易失真,核心瓶颈是光度多义性。北航与新国大团队提出AmbiSuR框架,从表征和监督层面解决问题,实验证明其在多数据集表现优异。

机器之心
新闻资讯7

国产算力解决方案,如何赋能“AI for Science”?

AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。

芯师爷
产品应用7

与Banana Pro过过招,国产Libcom图像合成工作台开启Labubu漫游记

2025年AIGC热度再创新高,通用图像编辑大模型虽功能强大,但在细分领域有不足。上海交通大学牛力团队推出并升级了Libcom图像合成工作台,与Nano Banana Pro对比,其在图像合成上表现更稳定。

机器之心
新闻资讯7

Ilya、小扎之后,苏莱曼的「超级智能」进入7年倒计时!

主流AI公司从谈AGI转向「超级智能」。微软AI CEO苏莱曼宣布成立MAI超级智能团队,他定义的超级智能是人本主义的,重点布局三个领域,还面临安全可控等挑战,微软有7年窗口期。

新智元