多代理系统」共找到 5436 篇相关文章

开源动态8

视频理解新标杆,快手模态推理模型开源:128k上下文+0.1秒级视频定位+跨模态推理

快手开源能看懂视频并跨模态推理的大模型Keye-VL 1.5,其有时序定位、描述和推理能力,跑分领先。采用三段式架构和Slow-Fast编码策略,经四阶段预训练和阶段后处理,团队成果,推动模态技术落地。

量子位
算法论文8

Shopee OnePiece:业内首个融合上下文工程、隐式推理和目标训练策略的生成式搜推建模框架

2025年生成式推荐发展火热,但工业界落地在序列化建模,替换传统范式遇阻。Shopee傅聪团队联合人大高瓴学院提出OnePiece范式,是业内首个融合策略的生成式搜推建模框架,含上下文工程、隐式推理和目标训练策略。

InfoQ
开源动态8

最新智能体自动操作手机电脑,10个榜单开源SOTA全拿下|通义实验室

通义实验室推出Mobile - Agent - v3智能体框架,在核心榜单获开源最佳。它能完成复杂任务,在智能体框架中灵活切换角色。团队搭建云环境基建,从维度构建数据,用强化学习和智能体协作提升其性能。

量子位
产品应用2

cursor 2.0实测:cursor的摆烂之作

作者实测Cursor 2.0后大失所望。它交互粗糙,智能体虽有个回答但选方案操作不明;因Claude涨价推出智能分发和自研Composer,后者除快无优势且需魔法;内置浏览器交互麻烦,窗口管理离谱,语音模式基本不可用。

AI产品自由
新闻资讯8

在这场大会上,我们看到了AI进入物理世界后的样子|甲子光年

第七届北京智源大会亮点,有四位图灵奖得主。议题紧跟前沿,设20个论坛和180余场报告。现场展示个机器人应用。智源发布“悟界”系列大模型,还聚焦开源,升级FlagOS系统。两位图灵奖得主对AI安全看法不一。

甲子光年
产品应用7

8个月营收提高4倍,n8n如何成为AI Agent最受欢迎的搭建平台?

n8n由前《加勒比海盗》视觉设计师创立,从工作流自动化工具升级为AI应用编排层。8个月营收提4倍,正进行超1亿美元融资。它能与AI无缝集成,有活跃社区,在场景应用广泛,不过用户为技术人员。

Founder Park
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在领域应用表现出色。

机器之心
开源动态8

普林斯顿团队领衔发布最强开源数学定理证明模型:32B性能大幅超越前代SOTA DeepSeek 671B

近日,普林斯顿大学牵头机构推出开源数学定理证明模型 Goedel-Prover-V2。其 32B 旗舰模型在基准测试超 DeepSeek-Prover-V2-671B,8B 小模型特定基准性能与之持平。该模型有三项关键创新,团队已公开模型及数据集。

机器之心
产品应用8

构建会思考的测试Agent:从自动化到自主智能的演进

文章介绍面向企业级软件测试的质量数字人系统,结合大语言模型等实现从传统到自主智能测试跨越。分析专有云测试困境,指出通用AI Agent平台局限,阐述系统设计、能力及架构,展示应用成果并展望扩展场景与未来计划。

阿里云开发者
算法论文8

AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确靠猜,推理漏洞,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位