「领域知识库」共找到 1832 篇相关文章
Meta「分割一切」3.0曝光!技能语义分割加入概念提示,好好玩,要爆了
Meta第三代“分割一切”模型SAM 3悄然投稿ICLR 2026。它支持基于概念提示的多实例分割,能听懂人话,处理图片快,还设计新架构、构建数据引擎、提出SA - Co基准,实验表现佳但也有局限。
国产游戏理解模型刷新SOTA,对话逗逗AI CEO:开源模型+行业数据是突破关键
2025年末国产开源模型影响力凸显,东京电玩展上逗逗AI的游戏理解模型LynkSoul VLM v1超顶尖闭源模型。其CEO刘斌新表示,开源模型结合行业数据是突破关键,还探讨了产品技术、交互及发展趋势等。
OVI:统一的音视频生成模型,声音与画面同步诞生
音视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。
用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架
张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。
Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×
Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为大模型与知识库结合提供新范式。
Google DeepMind CEO Hassabis 最新访谈:未来十年实现完整 AGI,引领科学黄金时代
Google DeepMind CEO Demis Hassabis在访谈中分享诸多观点。他认为未来十年能实现完整AGI,还谈到Genie 3重新定义视频、人形机器人重要性等,指出AI创造力不足等局限,也提及旗下公司在制药等领域突破。
字节跳动开源超强USO模型,AI绘图六边形战士来了
在AI图像生成领域,风格和主题驱动的图像生成一直脱节。字节跳动智能创作实验室推出USO模型,构建海量数据集,设计两阶段训练法,引入风格奖励学习范式,化解此难题,且已全面开源。
没有法律背景、聊了100位律师后开始创业,他搞出了一家7亿美元估值的AI公司
Legora是法律科技赛道增长快的创企,获8000万美元B轮融资,估值6.75亿美元。其25岁无法律背景创始人Max Junestrand分享创业思考,涉及产品、销售、竞争等,为垂直领域AI创业提供借鉴。
专访 RockFlow Vakee:AI 如何重构投资体验,让金融“说人话”
该专访对话 RockFlow 创始人 Vakee,探讨 AI 重构投资体验。她分享创业初衷、团队理念及人才需求,还谈及 GenZ 投资特点与 RockFlow 应对策略,介绍了 Bobby 功能、规划及 RockFlow 在金融科技领域的发展方向。
万物皆可AI的时代?Arm发布全球首个Armv9边缘AI计算平台
Arm发布全球首个Armv9边缘AI计算平台,核心是Cortex - A320 CPU和Ethos - U85 NPU,能让小设备本地运行超10亿参数AI模型。边缘AI市场增长快,Arm转型切入,平台软硬结合优势明显,还有豪华朋友圈支持。