「深度研究能力」共找到 5241 篇相关文章

算法论文8

SIGGRAPH 2026 | 无需训练,一段单目视频解锁任意运镜与「子弹时间」

来自UIUC、宾大与Netflix Eyeline Labs的研究团队提出FreeOrbit4D,无需训练模型,用单目视频就能实现任意运镜和“子弹时间”。它通过“前景补全的4D重建”提供几何支架,在大角度视角变化下表现出色,还带来诸多应用。

机器之心
算法论文8

蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三大幻觉,现已接入MTEB

蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。

AINLPer
产品应用7

6个电子牛马替我上班,腾讯马维斯好用吗?

5月20日腾讯上线AI助手马维斯,由六个AI Agent组成。经测试,它在定时任务、搜索整理、竞品分析等场景有表现,但也存在文件操作易出错、图片识别不稳定、分析深度不足等问题。其背靠腾讯生态有渠道优势,但需提升体验促使用户留存。

芯师爷
新闻资讯7

当国产模型追上闭源旗舰,企业 AI 编程的真正障碍才浮出水面

过去企业AI Coding讨论多集中在模型能力等方面,DeepSeek V4出现缓解了模型问题,但更深层的代码库业务隐知识等问题浮现。合规限制使企业工具建设受阻,V4打破了模型供应瓶颈,可组织知识管理仍成难题。

InfoQ
开源动态8

GLM-5.1夺开源模型第一,长程任务更稳,一句话就能生成文章短视频

智谱官宣GLM-5.1开源,代码能力增强,在三项代码评测基准综合平均分上,取得全球模型第三、国产及开源模型第一。它专为长程任务设计,能8小时持续工作,还能一句话生成短视频,是平替Claude Sonnet 4.6的优选项。

AI工程化
推荐文章8

多模态大语言模型的核心技术架构与训练方法的进化

文章深入剖析多模态大语言模型核心技术架构与训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径与代表模型,还提及国内模型创新及开源模型OpenVLA。

AIGC开放社区
新闻资讯7

刚刚,MOSS孙天祥创业,直播AI4AI大规模科研

创业公司Analemma将全球公开直播部署端到端AI研究系统FARS,目标是全自动完成100篇论文,直播预计持续一个月。FARS是无人类干预、纯AI驱动的系统,能完成科研全流程。其创始人是孙天祥,团队年轻且获数千万美元融资。

机器之心
新闻资讯7

字节阿里DeepSeek决战春节:一场关乎14亿人的重磅AI大战

春节将至,字节、阿里和DeepSeek间的AI大战拉开帷幕。字节将推三款多模态旗舰模型;阿里或发布Qwen 3.5,让千问打通支付与电商;DeepSeek V4或携强代码能力突袭。这是对用户生活入口和互联网秩序的争夺。

新智元
算法论文7

为什么AI总是"记错"你?我们造了一个"合成人生"来测试

现有AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验有反直觉结论并给出设计启示。

深度学习自然语言处理
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。

Hugging Face