agent能力」共找到 5199 篇相关文章

开源动态8

开源版MetaQuery来了!OpenUni用1.1B参数媲美BLIP3-o-8B,数据代码完全开源

南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数达 8B 模型性能,代码、权重、数据全开源。它架构极简、参数高效,还继承了多模态理解能力

机器之心
新闻资讯7

99% 确定:OpenAI Dev Day 将发布可视化 AI 工作流工具,“AI Fabric”成为新的关键词

全网传 OpenAI 将在 Dev Day 发布类似 n8n、dify 的 Agent Builder,TestingCatalog 试用称其为‘最流畅的 Agent 构建画布’。它能让开发者在统一界面操作,或影响自动化工具市场。

AI工程化
算法论文8

5700问答对全面评估拷问AI空间感!最新空间智能评测基准来了丨浙大&成电&港中文

当前视觉语言大模型空间信息学习片段化,缺乏多维度空间推理能力。浙大、成电和港中文团队提出ViewSpatial - Bench基准体系,评估主流模型,揭示其缺陷,并开发MVSM优化跨视角空间理解。

量子位
新闻资讯7

老黄爆改英伟达,Salesforce一次招千人!智能体时代应届生机会来了

Salesforce CEO Marc Benioff要招1000名应届生或实习生,IBM北美入门级岗位扩招3倍,麦肯锡等也在扩招。智能体时代新入门岗位诞生,应届生定义将被重写,会与agent协作的人是企业争抢对象。

新智元
新闻资讯8

刚刚,Claude 4.1 发布

刚刚,Anthropic 发布 Claude Opus 4.1,对智能体任务、编码和推理能力全面升级,付费用户已可使用。未来几周还有重大改进。它在多方面能力提升,碾压对手,网友反应热烈。

AGI Hunt
产品应用8

超越Runway!Adobe发布新神器:P视频比P图还简单

Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力

新智元
新闻资讯8

英伟达震撼首测Vera Rubin,DeepSeek吞吐暴涨30倍!

英伟达公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。

新智元
算法论文8

上海AI Lab新研究:SFT能泛化,只要满足这三个条件

上海人工智能实验室等团队研究指出,“SFT泛化能力差”定论有局限。SFT泛化能力受优化过程、数据质量与结构、模型基础能力共同制约,研究还揭示其训练中的现象及副作用。

量子位
产品应用7

文档解析OCR全新升级,追平Gemini2.5pro,超越MinerU、碾压Qwen2.5VL-72B

CourseAI介绍PP - StructureV3实战、能力、性能与架构。它在通用版面解析等方面能力强,更新PP - OCRv5提升准确率,超主流OCR方案,轻且速度快,但遇特殊情况需重新训练。

CourseAI
产品应用8

全球1100万台出货,追觅打造最聪明的扫地机

追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。

AI科技评论