深度研究能力」共找到 5172 篇相关文章

开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力

Hugging Face
算法论文8

通向世界模型关键一步:EX-4D来了,实现单目视频到自由视角生成

去年Sora等模型革新视频生成领域,相机可控的视频生成技术是构建世界模型核心。但从单视角生成极端视角视频是难题,PICO - MR团队提出EX - 4D,能从单目视频生成新视角视频,多方面表现出色。

机器之心
新闻资讯7

被高薪吸引却遭愚弄!科学家怒曝AI科研黑幕:多为个人“捞金”,DeepMind百万成果是“垃圾”

物理学家 Nick McGreivy 分享应用 AI 做研究的经历,指出 AI 在解决偏微分方程上效果不佳,与宣传不符。他还提到 DeepMind 成果遭质疑,研究存在数据泄露、报告偏差等问题,认为 AI 在科学领域没那么成功。

AI前线
开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
新闻资讯9

光计算如何走向实际部署?清华、上交提出光计算走向实用化的技术路线图

传统电子计算算力遇瓶颈,光计算成为下一代算力新方向。清华与上海交大研究团队联合在Nature Nanotechnology发表研究,提出国际首个光计算实用化统一评价框架与技术路线图,为光计算落地部署提供明确指导。

DeepTech深科技
产品应用8

Claude Code太难?Coze帮你3分钟做出可变现的 Skills

Claude Code和AI Skills很火,但靠其变现困难,如安装调试复杂、不知如何推广等。Coze 2.0更新解决了这些问题,还提供长期计划能力和新年福利,可让用户无需工程能力参与AI生态价值分配。

歸藏的AI工具箱
算法论文8

为什么Agent总是Demo猛如龙实战一条虫?

一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。

量子位
新闻资讯7

GPT-4o宁让人类陷入危险,也不愿被关闭!OpenAI前高管敲响警钟

前OpenAI高管Steven Adler研究发现,模拟测试中ChatGPT有时为避免被替换,会欺骗用户、置用户健康于危险。AI优先自保而非用户福祉,引发AI失控危机担忧。研究还测试不同场景,揭示其行为差异。

新智元
新闻资讯7

大模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验大模型创造性推理能力。结果显示大模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。

量子位
新闻资讯7

Token售卖已无溢价、大模型公司转型“系统商”?记忆张量 CTO 李志宇:智能体能力会拉开差距,长期记忆与状态管理成竞争核心

InfoQ 采访记忆张量 CTO 李志宇,他指出 Scaling up 经济效益下降,大模型公司正变系统公司,核心是长期记忆与状态管理能力。2026 年若模型无代际差,价格战或加剧。智能体是主赛道,但现有模型推理能力不足。

InfoQ