「模型能力」共找到 9120 篇相关文章

算法论文7

为何95%的AI项目注定失败?回到未来,策略型代理AI才是正确路径

《代理AI的进展:回到未来》指出,当前95%的AI项目失败因企业缺乏消费模型的架构。文章提出‘机器中的机器’理论,论证策略型代理AI是企业转型路径,还阐述构建算法化企业生态的方法。

AIGC开放社区
推荐文章8

创业者思考:如何做 AI Agent 喜欢的基础软件?

作者黄东旭指出Infra软件主要使用者正从开发者转向AI Agent,以TiDB Cloud为例说明趋势已现。他探讨如何做AI Agent喜欢的基础软件,从心智模型、接口设计、必要特征、商业模式等方面给出建议。

Founder Park
产品应用7

产品研发AI提效实践:PRD智能体在需求领域的提效探索

随着AI发展,企业探索用其优化产品开发流程。文章介绍PRD和系分智能体落地进展,目标提升产研效率、规范文档管理,阐述技术方案、能力展示,也指出RAG链路等方面挑战及后续研究方向。

阿里云开发者
新闻资讯7

硅谷VC新玩法"Kingmaking":还没写代码也能拿到上千万投资

过去半年,三家未成型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因大模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
8

AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星

香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。

新智元
开源动态8

AI点外卖哪家强,美团LongCat团队做了个全面评测

美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。

量子位
新闻资讯7

AI顶会反噬整个学术圈!「不发表就会死」,NeurIPS爆仓,博士年肝4.5篇大崩溃

NUS研究者指出,NeurIPS等AI顶会投稿量激增,正反噬学术圈。当前模式存在结构性危机,如学术产出泡沫化、环境代价高、研究者心理负荷大等。为此,他们提出“社区联邦会议”(CFC)模型以解决问题。

新智元
新闻资讯7

马斯克宣布:Grok学会看片了!无字幕看懂陶哲轩菲奖级难题

马斯克宣布Grok可分析任何视频。它能对伪造视频鉴假溯源,但也有处理画面靠字幕、有幻觉问题和效果不稳定的缺陷。实测中它能理解无字幕视频,还整理访谈内容。这功能虽便利,但引发人类能力退化担忧。

新智元
产品应用8

刚刚,OpenClaw最猛升级!底层架构大换血,全网等了9天

OpenClaw「2026.3.22-beta.1」预览版上线,对插件系统重构,新SDK替代旧API,ClawHub成首选分发渠道;安全防护升级,封堵多个漏洞;模型配置升至GPT - 5.4,接入Anthropic Vertex等;多平台体验和Agent引擎也有优化。

新智元
新闻资讯7

给 Agent 接搜索功能,有哪些「坑」需要特别注意?

搜索是AI产品标配,但给AI接搜索不易,给人用和给AI用的搜索差异大。信息检索质量影响Agent推理与任务完成度。邀请小宿科技相关人员聊给Agent接入搜索能力,10月30日20点线上闭门活动可扫码报名。

Founder Park