「模型能力提升」共找到 10014 篇相关文章

推荐文章8

相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么

文章围绕 Agent Protocol 展开,指出框架更迭但生产级 Agent 系统问题不变。以 Agent Protocol 为主线拆分 Agent Runtime,探讨其核心、稳定对象、执行模型等,还对比各框架在多维度的表现并给出设计建议。

阿里云开发者
新闻资讯8

帮大家总结了一下凌晨的Google I/O 2026开发者大会。

本文总结Google I/O 2026开发者大会成果,涵盖AI模型、产品、Agent系统、视觉生成、搜索、电商等多领域。如推出Gemini 3.5 Flash,升级产品功能,发布新Agent系统,推进电商协议,还有科研成果与硬件更新。

数字生命卡兹克
产品应用8

GPU利用率不到15%,AI产业最大的浪费正在被这家公司改写|甲子光年

AI产业发展中算力成本高、利用率低问题凸显。趋动科技押注‘软件定义GPU’,试图把独占GPU变为共享算力池,其产品使客户GPU利用率平均提升约4倍,已服务超200家头部客户。

甲子光年
算法论文7

为何95%的AI项目注定失败?回到未来,策略型代理AI才是正确路径

《代理AI的进展:回到未来》指出,当前95%的AI项目失败因企业缺乏消费模型的架构。文章提出‘机器中的机器’理论,论证策略型代理AI是企业转型路径,还阐述构建算法化企业生态的方法。

AIGC开放社区
推荐文章8

创业者思考:如何做 AI Agent 喜欢的基础软件?

作者黄东旭指出Infra软件主要使用者正从开发者转向AI Agent,以TiDB Cloud为例说明趋势已现。他探讨如何做AI Agent喜欢的基础软件,从心智模型、接口设计、必要特征、商业模式等方面给出建议。

Founder Park
新闻资讯7

硅谷VC新玩法"Kingmaking":还没写代码也能拿到上千万投资

过去半年,三家未成型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因大模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
8

AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星

香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。

新智元
开源动态8

AI点外卖哪家强,美团LongCat团队做了个全面评测

美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。

量子位
新闻资讯7

AI顶会反噬整个学术圈!「不发表就会死」,NeurIPS爆仓,博士年肝4.5篇大崩溃

NUS研究者指出,NeurIPS等AI顶会投稿量激增,正反噬学术圈。当前模式存在结构性危机,如学术产出泡沫化、环境代价高、研究者心理负荷大等。为此,他们提出“社区联邦会议”(CFC)模型以解决问题。

新智元
新闻资讯7

马斯克宣布:Grok学会看片了!无字幕看懂陶哲轩菲奖级难题

马斯克宣布Grok可分析任何视频。它能对伪造视频鉴假溯源,但也有处理画面靠字幕、有幻觉问题和效果不稳定的缺陷。实测中它能理解无字幕视频,还整理访谈内容。这功能虽便利,但引发人类能力退化担忧。

新智元