多模型 Agent」共找到 10765 篇相关文章

开源动态8

模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一

个机构研究人员联合发布全新语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。

量子位
开源动态7

腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告

腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等任务。基于openai - agents构建,适配模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。

CourseAI
产品应用7

18 岁创业者用 OpenClaw 管 16 个 AI Agent,一个人的 Agent 公司怎么运转

18岁无编程背景创业者用OpenClaw搭建Agent协作平台,16个Agent分工明确,配合Claude、GLM等工具提升生产力。他分享工作流搭建、成本、模型选择等经验,还谈了对OpenClaw发展的看法。

InfoQ
开源动态8

企业级OpenClaw最强拍档来了!万亿参数的国产模态大模型,刚刚开源发布

YuanLab.ai团队开源源Yuan3.0 Ultra模态基础大模型,是万亿级开源模态大模型之一。它优化训练效率,在任务表现突出,为企业Agent AI提供支撑,还提出新算法和训练策略,全面开源推动落地。

量子位
产品应用8

阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型

5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。

InfoQ
新闻资讯8

LangChain Agent 年度报告:输出质量仍是 Agent 最大障碍,客服、研究是最快落地场景

LangChain对1300名行业人士调查,揭示AI Agent应用情况。超半数受访者已将Agent投入生产,客户服务、研究与数据分析是热门方向,但输出质量仍是落地最大障碍,成本不再是难题。

Founder Park
算法论文8

0.005%参数量超越SOTA!提升模型能力无需庞大奖励模型

上海交通大学等校联合团队提出轻量级奖励模型SWIFT,利用大模型隐藏状态线性特征,仅训练极小线性层,在推理任务中超越主流奖励模型,实现计算效率与准确率双提升,且在领域表现出色。

AIGC开放社区
产品应用7

实测Kimi全新Agent模型「OK Computer」,很OK

Kimi发布全新Agent模型「OK Computer」,依托Kimi K2,能搭网站、做PPT、处理大量数据。实测显示它在设计、生成、分析类任务表现不错,设计无需找素材,分析无需想角度,生成还能推荐风格。

量子位
产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型

Qwen3-LiveTranslate-Flash 是基于大语言模型语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有语言和方言支持、视觉增强等亮点,性能超主流大模型

通义千问Qwen
开源动态8

GitHub 狂揽 12K Star!把 OpenClaw 以及所有 Code Agent 工具装进一个界面!

AionUi是本地优先、开源免费的AI Cowork平台,将散落终端的命令行AI工具统一到图形界面。它兼容主流工具,有统一平台、工具支持等特点,还具备任务并行等核心能力,适合Code Agent用户。

开源星探