元数据」共找到 3109 篇相关文章

算法论文8

刚刚,加入腾讯的姚顺雨发表首篇Paper~

腾讯混与复旦联合发表论文《CL-bench》,姚顺雨署名并全面细致审阅反馈。CL-BENCH 首次单独考‘现学现卖’,有独特设计原则、四大题型,其评分杜绝‘差不多’,还让 10 个前沿模型‘翻车’。

PaperAgent
产品应用8

音乐新王震撼降临,Al音乐进入格莱美时刻

2026开年,MiniMax Music 2.5发布,凭「格莱美级」音质、极致拟真人声开创AI音乐新高度。它消除中文演唱「洋味儿」,支持14种结构标签精准控制,让音乐制作门槛降低,从C端娱乐迈向B端生产力。

新智元
算法论文8

拿着做数学题的 PRM 来评判 Agent 调用工具,基本是行不通的!

目前评估体系多为结果导向,在工具调用上缺乏像样的PRM基准。Arizona State University和Intuit AI Research研究者推出ToolPRMBench,指出用做数学题的PRM评判Agent调用工具行不通,还介绍了其构建方法、训练范式和实验结果。

深度学习自然语言处理
新闻资讯7

硅谷真实「无间道」!OpenAI前CTO怒斩泄密联创,奥特曼打包收了

硅谷AI圈上演“无间道”,Thinking Machines Lab掌门人Mira Murati开除被指泄密的CTO Barret Zoph,OpenAI迅速接人。这重创了TML,Mira宣布“PyTorch之父”Soumith Chintala出任新CTO。

新智元
推荐文章8

当顶级视频模型半衰期只有 30 天,fal.ai 为什么收入反而一年增长 60 倍?

在生成式媒体技术发展背景下,fal.ai 作为生成式媒体 infra 公司迅速崛起。它通过统一 API 与云端平台提供多模态模型调用能力,2025 年收入增长 60 倍并完成融资。文章解析其如何构建护城河及对行业发展的判断。

海外独角兽
算法论文8

别被室内基准高分骗了:大模型是在推理空间,还是在「背答案」?

2025年,空间智能成大模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院大学等机构发布OSI - Bench重新审视大模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
推荐文章7

从算法天才到机器人造梦者,原力灵机范浩强详解具身智能进化论:模型解锁场景,场景定义硬件

AI 前线深度访谈原力灵机范浩强,探讨其创业选择、具身智能技术演进与产业趋势。他认为机器人是 AI 绕不过的点,2025 年硬件与算法拼图开始对齐,原力灵机强调算法先行,还分享了保证算法演进的路线。

AI前线
开源动态8

2026 开年 AI 巨作!超强搜索智能体模型 MiroThinker 1.5 开源,慢思考做到了极致!

2026年开局,MiroMind团队开源超强搜索智能体模型MiroThinker 1.5。它不是“秒回型AI”,会深入研究后输出有引用、数据和逻辑的研报,以“慢思考”机制在深度任务上表现出色。

开源星探
算法论文8

System 3 觉醒:从“工具”到“物种”的根本改变

西湖大学与上海交大新论文提出System 3概念及Sophia框架,将认知心理学概念映射到代码模块,让AI Agent像“生命体”生存。采用前向学习和混合奖励机制,实验显示其能力显著进化,为人工生命指明道路。

深度学习自然语言处理
新闻资讯7

国产算力解决方案,如何赋能“AI for Science”?

AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。

芯师爷