智源大会」共找到 5920 篇相关文章

产品应用7

用最简单的模型技术打造一个迁云专家有多难?

文章探讨在云迁移领域用模型技术“复制”专家80%核心能力。分析标准化方案不足及简单RAG局限,介绍“LX0.1”AI专家助手构建,还提及分层评测、人机协同等优化,最后展望AI在云迁移的未来方向。

阿里云开发者
产品应用8

一场对话,我们细扒了下文心模型背后的技术

信通院模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。

量子位
新闻资讯7

行业迎来洗牌!4万 Agent 挤进一个机柜,AI Infra 要如何构建?

当 AI 从聊天机器人变为 Agent 后,AI 基础设施逻辑改变。浪潮信息副总经理赵帅判断,Agent 迫使 AI 基础设施重新分工,带来新的 CPU 计算需求。企业需关注资源分配、成本控制、系统重构等问题。

InfoQ
产品应用8

构建思考的测试Agent:从自动化到自主智能的演进

文章介绍面向企业级软件测试的质量数字人系统,结合语言模型等实现从传统到自主智能测试跨越。分析专有云测试困境,指出通用AI Agent平台局限,阐述系统设计、能力及架构,展示应用成果并展望扩展场景与未来计划。

阿里云开发者
算法论文7

模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
新闻资讯8

一文带你通俗易懂的看懂"人工智能+",这是十年一遇的机遇。

作者解读《关于深入实施“人工智能+”行动的意见》,对比‘互联网+’指出‘人工智能+’核心是‘赋能’,还阐述其在多领域的应用及影响,最后提醒家面对挑战抓住机遇。

数字生命卡兹克
开源动态8

Anthropic祭出模型“读脑”杀手锏:LLM决策过程全给你扒开看

Anthropic宣布开源电路追踪工具,可追踪LLM神经元,通过生成“归因图谱”揭示模型输出原因。开源了生成图谱的库和交互式前端,并提供demo notebook。可追踪电路、可视化图谱、检验假设。

AI寒武纪
算法论文8

首篇WebAgents综述:模型赋能AI Agent,实现下一代Web自动化

互联网任务重复繁琐,香港理工学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。

新智元
开源动态8

Claude团队打开模型「脑回路」,开源LLM思维可视化工具来了

Claude团队推出“电路追踪”工具,可生成归因图呈现LLM处理信息路径,支持在主流开源权重模型上快速生成。研究人员能借此解码LLM“决策逻辑”,官方还给出多语言电路等示例。

量子位
算法论文8

团队直击模型高分神话:人类90分,最强模型仅49分

南京学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元