通用验证器」共找到 1690 篇相关文章

推荐文章8

手把手带你构建第一个业务本体(Ontology):为 Agent 绘制业务地图。

文章介绍为企业AI Agent构建业务本体,阐述Agent需本体的原因,讲解TBox与ABox概念。给出构建流程,介绍RDF/OWL标准及Protégé等工具,实战构建‘订单加急交付’本体并验证,还演示Python程序推理,展望本体应用场景。

AI大模型应用实践
推荐文章7

关于 AI Agent,你最想知道的 3 个问题——为什么我说“垂直 Agent”是个伪命题

文章解答了关于 AI Agent 的三个读者问题,包括概念定义、大厂推出的原因及商业化前景、通用与垂直类 Agent 的商业前景。指出 Agent 是 AI 落地有价值方向,目前有挑战,真正机会在围绕其构建的数据、工具和行业理解。

宝玉AI
新闻资讯8

OpenAI重大发现:GPT-4b micro改造诺奖研究,山中因子重编程效率提高50倍

OpenAI与Retro Bio合作,用新模型GPT - 4b micro设计出新型山中因子变体,使重编程效率提高50倍。此前山中因子重编程效率极低,限制其应用,此次改进是突破。研究还在多方面验证了变体效果。

机器之心
算法论文8

斯坦福洗碗机人新作!灵巧手跟人学采茶做早餐,CoRL 2025提名最佳论文

斯坦福等机构提出DexUMI框架,利用人手将操作技能迁移至灵巧手。该框架通过软硬件创新缩小人手与灵巧手具身差异,在两款灵巧手硬件平台验证,平均任务成功率达86%,数据采集效率提升3.2倍,被CoRL 2025提名最佳论文。

量子位
推荐文章7

Thinking Machines 发布第二篇博文:用模块化流形让训练更加稳定高效

Thinking Machines实验室发布第二篇Connectionism研究文章,提出模块化流形理论框架,通过在权重矩阵施加流形约束让神经网络训练更稳定高效。文章从几何角度思考优化问题,提出流形Muon优化,还探讨了模块化流形扩展到大型网络的方法。

AGI Hunt
推荐文章7

具身智能还需要一个「五年耐心」

作者与具身智能领域人士交流后认为,具身智能还需「五年耐心」。当下通用人进工业产线挑战大,一到两年或迎「GPT - 3.0 时刻」,但到「GPT - 4.0」阶段还需解决数据、硬件等诸多问题。

Founder Park
新闻资讯8

7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律

非营利研究机构METR报告显示,Agent能力每7个月翻一番,这在9项基准测试中得到验证,任务涉及编程、数学等领域,大模型正迈向高度自动化,且Agent性能提升快,未来处理复杂任务能力或更强。

量子位
产品应用7

实测飞猪 AI:真正的突围才刚刚开始?

2026年上半年,AI行业面临盈利难题,AI Coding虽火热,但旅游等领域落地AI更具挑战与潜力。飞猪升级AI能力推出「飞猪帮帮」,能办事、融合交互方式,还解决通用模型痛点,不过落地成闭环仍需供应商适配。

AI科技评论
开源动态8

更高智商更快思考!蚂蚁开源最新万亿语言模型,多项复杂推理SOTA

蚂蚁正式发布拥有万亿参数的通用语言模型Ling-1T,超越多个开源和闭源模型,在多项复杂推理基准中取得SOTA表现。它推理和代码能力强,研发采用‘中训练+后训练’,还提出新奖励机制和LPO方法。

量子位
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区