大模型Agent」共找到 10482 篇相关文章

开源动态8

阿里又上新!开源 7B 文生图模型,专治图中文字,效果媲美 20B+ 模型

阿里 AIDC - AI 团队开源 7B 参数文生图模型 Ovis - Image,主打图中文字生成。它文本渲染能力强,在权威榜单成绩好,媲美 20B + 模型,官方还提供使用方法,是设计类刚需模型

开源星探
推荐文章7

为什么堆算力救不了模型

文章指出模型和人类脑归纳规律路径不同,AI追求精确但脆弱的拟合,人追求粗糙但不变的压缩。模型在可收敛系统表现惊艳,不可收敛系统则崩盘,未来AI产品核心是打造可收敛封闭环境。

AI科技评论
产品应用8

融合风控知识的模型体系建设与应用实践

腾讯算法专家欧阳天雄在AICon会分享《模型驱动下的智能风控落地实践》,介绍腾讯天御融合海量风控知识构建金融风控模型,解决传统风控模型难题,还展示构建技术、工程实践及落地案例,为金融风控提供新思路。

InfoQ
产品应用8

文心新出的推理模型,给了我们信心

在 WAVE SUMMIT 2025 会上,百度发布文心模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。

机器之心
算法论文8

LeCun有了新证据!模型思考与人类思考存在本质差别

Yann LeCun参与的研究用信息论揭示语言模型与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流模型,发现AI与人类在‘理解’上有三核心差异,对当前AI发展趋势提出挑战。

AI工程化
开源动态7

OpenClaw 之后,Agentic RL有了新训练范式

模型技术推动AI从‘回答问题’迈向‘执行任务’,Agentic AI兴起。中国科认知智能全国重点实验室提出Claw - R1项目,将前沿Agent Runtime与强化学习训练框架结合,为Agentic AI提供新训练基础设施。

PaperAgent
算法论文8

AI 会笑吗?BIGAI & 上交团队:多模态模型是否真的能 get 到视频笑点|ACL 2026

上海交通学等团队构建v-HUB评测基准,分析多模态模型视频幽默理解能力。评测7个前沿模型发现,模型依赖文字、主动发现笑点能力弱,声音作用有限,还需考虑隐形线索。

AI科技评论
产品应用7

火山引擎,「出击」Agent

2025 年年中模型竞争进入下半场,Agent 成焦点。文章分析其 2B 与 2C 落地困境,介绍火山引擎新开发范式,如 TRAE、豆包模型 1.6、PromptPilot 等,助企业解决 B 端落地难题。

AI科技评论
算法论文8

ACL 2025 | 指令遵循不能仅靠常识?GuideBench 揭示模型如何“踩雷”领域指南规则

这篇ACL 2025主会论文聚焦提升智能体指南规则遵循能力。提出评估基准GuideBench,涵盖7类1272个任务。实验显示多数主流模型指令遵循能力不佳,尤其数学推理挑战,为模型迭代提供评估基准。

深度学习自然语言处理
推荐文章8

有手就行,教你从0到1快速手搓搭建个GUI Agent

随着通用模型发展,搭建GUI Agent难度降低。文章介绍如何用通用模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。

腾讯技术工程