「AI基准测试」共找到 10907 篇相关文章

推荐文章7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ
新闻资讯8

MMLab@HKU 闪耀 CVPR 2025!与全球顶尖学者共话 AI 前沿

CVPR 2025 于 6 月 11 日至 15 日在美国纳什维尔举行,MMLab@HKU 携 24 篇高质量论文亮相。其还是三项国际竞赛的发起与主办方,主办六项前沿活动,研究成果展示了多领域进步。

AI科技评论
产品应用7

Cursor 内置三大文档工具,为AI 编程注入精准上下文

大模型编程易因知识陈旧致代码出错,为其提供实时上下文是关键。Cursor 有 @Docs、@Web、MCP 三大文档工具,能处理不同文档,还可协助创建和更新文档,弥合模型知识与项目需求的鸿沟。

AI工程化
算法论文8

何恺明等降维打击!彻底颠覆AI生图,无需预训练一步到位

何恺明团队推出生成模型MeanFlow,它跳脱传统训练范式,无需预训练等,仅一次函数评估就能完成生成。在ImageNet 256×256上表现优越,缩小了一步与多步模型性能差距。

新智元
算法论文8

「边思考、边搜索、边写作」WebThinker开启AI搜索&研究新纪元!

大型推理模型有推理能力,但静态知识限制其在复杂任务表现。WebThinker 让 LRM 推理中自主搜索、导航及写报告,集成探索器,有自主策略和训练工具,实验显示性能强,还指明未来探索方向。

机器之心
新闻资讯7

OpenAI发力AI应用!前Meta产品总裁将任应用部门CEO

Sam Altman宣布生鲜电商平台Instacart首席执行官Fidgi Simo加入OpenAI,担任新设立的应用部门CEO。该部门将整合业务和运营团队,推动研究成果惠及全球用户,实现规模化扩张。

AI工程化
推荐文章8

刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升

翁荔新博客聚焦Harness Engineering,梳理围绕‘Harness自我优化’的研究,探讨递归式自我提升发生层面,还指出自动化研究和自我提升系统面临的瓶颈,如评估标准模糊、奖励作弊等。

机器之心
新闻资讯8

估值315亿!田渊栋AI创业,谷歌、英伟达和AMD参投

Meta离职的田渊栋官宣创业,成立RSI,获6.5亿美元融资,估值约316亿。8位联创阵容豪华,团队致力于构建开放式架构,让智能体自主学习升级,目标打造具5万博士能力的智能系统。

AIGC开放社区
产品应用7

重生之我在AI时代当老板:让一群Agent互相PUA

MiniMax推出新Agent Mavis,可组建团队完成任务。其Agent Team分工明确,能解决单Agent在长程任务中的痛点,还将开源。此外,TokenPlan和Agent Plan合并,性价比提升。

量子位
新闻资讯7

国家队出手!AI智能体要发「身份证」,首个互联国标将落地

2026年5月8日,多部门联合发布《实施意见》,推动智能体应用,加强AIP等关键国标应用。全国信标委编制的AIP系列国标将公布,现启动AIP协议应用验证先锋计划,招募伙伴开展工作并明确权益义务。

新智元