「科研范式变革」共找到 1536 篇相关文章
对话英诺王建明:机器人目前面临的核心问题是数据 | GAIR 2025
英诺天使基金王建明在访谈中指出机器人核心问题是数据,若不解决,具身行业现有范式难行。她还分享对行业认知、投资项目看法,分析资本现状、风险及格局,对创业者给出建议。
11月必读!谷歌最新智能体白皮书(2025年11月),免费下载,52页pdf
Google团队发布《智能体简介(2025年11月版)》白皮书,可免费下载。它为开发者构筑智能体架构绘蓝图,剖析智能体三大支柱,提出分级体系,阐述开发者角色变革,理念与架构如航海图。
8个AI顶流科学家,300亿估值:他们要让AI自我进化
AI初创公司Recursive结束隐身状态,公布八位联合创始人名单,完成6.5亿美元A轮融资,估值达46.5亿美元。公司旨在推动自我改进型人工智能发展,让AI学会科研,虽面临挑战,但受算力产业链关注。
西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速
扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐新范式。
一周1.2k星!兼具质量与效率的OCR模型MonkeyOCR,支持多样化的中英文PDF
MonkeyOCR采用SRR三元组范式,简化多工具流程、避免整页文档处理低效问题。与MinerU、端到端模型相比性能更优,处理速度也更快。暂不支持拍摄文档解析,文章还给出安装、推理等操作步骤。
Relink:为GraphRAG动态构建证据图
大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。
全新唇同步技术OmniSync,遮挡,侧脸不在话下
唇同步对创建逼真视频内容很重要,但现有方法在身份一致、姿势变化等方面有局限。中国人大携手快手提出OmniSync,引入无需掩膜的训练范式,保证身份和姿态一致,能适应复杂场景,还建立AIGC - LipSync基准。
机器人为什么要拟人?终于有人正确回答了
今年6月,英伟达发布Isaac GR00T人形机器人参考平台,深度机智发布论文Human - as - Humanoid。具身智能瓶颈是数据,深度机智以人类学习范式破局,完成全栈技术闭环,领先优势扩大。
7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”
上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。
开源知识库,从 0 到上线,UltraRAG 企业知识库全流程实战 ,也许这是RAG最好的框架之一~~~
UltraRAG是基于MCP架构的轻量级RAG开发框架,核心设计工程友好。其3.0版强调推理可视化,适用于科研复现、企业知识库问答等场景,还介绍了使用方式,能解决RAG落地痛点。