多模态 Agent 模型」共找到 9435 篇相关文章

推荐文章8

Anthropic 最新博客:构建 AI Agent 评估体系完整指南

Anthropic 工程团队发布博客《Demystifying evals for AI agents》,揭秘内部对 AI Agent 的评估方法,涵盖评估结构、构建原因、常见 Agent 类型评估技术、评估非确定性处理、构建路线图及与其他方法配合策略等。

AGI Hunt
开源动态8

本地Opus你要不要!Qwen3.8-27B开源

阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能超Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent多模态跑分表现出色。

AIGC开放社区
推荐文章7

模型是不是到顶了?瓶颈到底在哪

文章探讨大模型是否到顶,指出‘到顶’争论分三个问题,靠堆大模型提升能力之路变平,受数据和成本约束。但大模型还有后训练和推理时计算两个发展方向,未来进步或来自更会用算力。

AI Reading Hub
算法论文8

Anthropic重磅研究:250份文档就能 “搞垮” 大模型

Anthropic等团队发布研究,进行大规模投毒攻击模拟。结论是投毒大模型所需‘毒药’数量与模型大小和干净数据量无关,取决于投毒文档绝对数量,250份就能‘搞垮’模型,改变了对AI安全的认知。

AIGC开放社区
新闻资讯7

「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?

Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。

机器之心
新闻资讯7

模型IMO25数学竞赛成绩公布了

模型挑战IMO 2025成绩出炉,Gemini 2.5 Pro以超30%总成绩断崖式领先,超出第二名89%。测试由MathArena组织,采用统一环境和双人匿名评估。还介绍了测试模型、题目及模型表现,人类版结果预计本周六发布。

量子位
产品应用8

一粒「扣子」,开启了Agent的全生命周期进化

2025年被视为Agent爆发元年,自年初通用Agent产品Manus出现后,其受关注程度空前。火山引擎Force 2025大会上,升级后的扣子成焦点,它从开发平台进化为全生命周期平台,覆盖开发、框架、调优、协作四大部分。

机器之心
新闻资讯7

《AI大模型与异构算力融合技术白皮书》10月10日发布

算泥社区《AI大模型与异构算力融合技术白皮书》10月10日14:00线上发布。AI大模型爆发使算力需求激增,异构算力成刚需。国内外政策与产业驱动其发展,该白皮书能为开发者提供实用技术参考。

AIGC开放社区
新闻资讯7

神秘模型「Pony Alpha」火了,被曝是GLM-5

OpenRouter上线神秘模型“Pony Alpha”,引发网友竞猜。该模型主打编码等,有高工具调用准确率。网友实测其前端能力惊艳。多项证据指向它可能是GLM - 5,春节档多家国产大模型将轮番上阵。

量子位
开源动态8

百度Qianfan-VL开源,纯国产自研昆仑芯跑出世界一流

百度开源全新视觉理解模型Qianfan-VL,有3B、8B和70B三个版本,在昆仑芯P800芯片上训练。该模型多模态能力强,OCR和教育场景表现突出,跑分超国际主流模型。芯片功耗低、架构优,模型训练方法创新。

AIGC开放社区