开源数据」共找到 4961 篇相关文章

开源动态8

50个Agent分工干活,Kimi K2.5的Agent“军团”把我看呆了。。。

Kimi K2.5今日下午发布并开源,具备多模态能力。它能根据视频、链接等复刻网站,有Visual Edit功能且自动部署上线。还有Agent Swarm场景,多Agent协作解决复杂问题,应用体验佳。

探索AGI
算法论文8

拿着做数学题的 PRM 来评判 Agent 调用工具,基本是行不通的!

目前评估体系多为结果导向,在工具调用上缺乏像样的PRM基准。Arizona State University和Intuit AI Research研究者推出ToolPRMBench,指出用做数学题的PRM评判Agent调用工具行不通,还介绍了其构建方法、训练范式和实验结果。

深度学习自然语言处理
算法论文8

拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式

使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源

机器之心
新闻资讯7

DeepSeek-R2要来了?

DeepSeek-R1发布一周年之际,其存储库更新引用全新「model 1」模型,极可能是R2。HuggingFace发文称R1降低技术、采用、心理三重壁垒。R1以推理优先,改变多项认知,故事仍在继续。

新智元
开源动态8

不到百万级,看不见 MCP 的真实问题:创始人亲述这疯狂的一年

本文是对 MCP 联合创作者 David Soria Parrra 的访谈,回顾 MCP 从发布到成为行业事实标准的历程,探讨其演进、应用、竞争对手等问题,还分享经验教训,展望未来发展方向。

AI前线
开源动态8

开源版Cowork爆火,逼得Anthropic下放Cowork

2026年1月,AI巨头Anthropic与开源项目Openwork展开定价权战争。开发者因嫌Claude Cowork贵,两天开发出Openwork。它免费、更快、更安全,迫使Anthropic将Cowork功能从$100档位下放至$20档位。

新智元
推荐文章8

当顶级视频模型半衰期只有 30 天,fal.ai 为什么收入反而一年增长 60 倍?

在生成式媒体技术发展背景下,fal.ai 作为生成式媒体 infra 公司迅速崛起。它通过统一 API 与云端平台提供多模态模型调用能力,2025 年收入增长 60 倍并完成融资。文章解析其如何构建护城河及对行业发展的判断。

海外独角兽
算法论文8

别被室内基准高分骗了:大模型是在推理空间,还是在「背答案」?

2025年,空间智能成大模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院大学等机构发布OSI - Bench重新审视大模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
推荐文章7

从算法天才到机器人造梦者,原力灵机范浩强详解具身智能进化论:模型解锁场景,场景定义硬件

AI 前线深度访谈原力灵机范浩强,探讨其创业选择、具身智能技术演进与产业趋势。他认为机器人是 AI 绕不过的点,2025 年硬件与算法拼图开始对齐,原力灵机强调算法先行,还分享了保证算法演进的路线。

AI前线
算法论文8

MIT这篇RLM论文,给出了Scaling的另一种可能~

当大家普遍认为解决长上下文问题要靠扩大模型上下文窗口时,MIT 最新的 RLM 论文提出新路径。其 code 已开源,能实现无界上下文处理,可让任意大语言模型处理 10 万 +token。

PaperAgent