时间相关性」共找到 1498 篇相关文章

算法论文8

ICML 2025 Oral工作再升级!上海AI Lab联合复旦、港中文推出支持更长视频理解的最佳工具VideoRoPE++

上海AI Lab联合复旦、港中文推出支持更长视频理解的工具VideoRoPE++。它确定了将RoPE应用于视频的关键特,构建评测基准V - RULER,提出外推方案YaRN - V,在多任务中优于先前RoPE变体。

机器之心
产品应用7

昇腾910B大模型实测:开源框架能不能打?真相全放这了

文章对昇腾 910B 大模型进行实测,对比 vLLM Ascend 与 MindIE 在实际推理场景中的能差异。通过 GPUStack 平台测试多种模型,结果显示两者在不同部署场景各有优势,vLLM 适合单卡小模型,MindIE 适合大模型多卡部署。

探索AGI
产品应用8

每帧Sora级震撼!Midjourney首个视频模型登场,超逼真大片首测来袭

Midjourney首个AI视频模型V1上线,每月10美金可体验20秒。其视觉效果惊艳,能媲美Sora等,还能一键让图像动起来。成本低,提供多种模式与设置,有技术愿景,未来将完善模块。

新智元
开源动态8

苹果 Containerization 提供了面向 macOS 的原生 Linux 容器支持

苹果在 2025 年 WWDC 发布 Containerization 和 Container CLI,可在 Mac 上以轻量级虚拟机方式创建和运行 Linux 容器,消除对 Docker 等第三方工具的需求,还开源了相关框架和工具。

InfoQ
开源动态8

如何选择最佳多模态大模型压缩方案?哈工大、度小满开源EFFIVLM-BENCH基准测试框架

金融科技智能化转型中,LVLM部署受算力瓶颈制约。哈工大与度小满联合开源EFFIVLM - BENCH基准测试框架,能为多模态大模型压缩方案出具‘体检报告’,还揭示LVLM加速复杂,推动技术发展。

机器之心
产品应用7

文档解析OCR全新升级,追平Gemini2.5pro,超越MinerU、碾压Qwen2.5VL-72B

CourseAI介绍PP - StructureV3实战、能力、能与架构。它在通用版面解析等方面能力强,更新PP - OCRv5提升准确率,超主流OCR方案,轻且速度快,但遇特殊情况需重新训练。

CourseAI
开源动态7

视频推理界的“福尔摩斯测试”:所有大模型,统统不及格 | 论文代码开源

腾讯ARC Lab和香港城市大学推出Video - Holmes,这是视频推理界的‘福尔摩斯测试’,能展现多模态大模型复杂视频推理能力的边界,规避现有Benchmark痛点,测试中所有大模型全部不及格,代码已开源。

量子位
算法论文8

说句话就能飞!北航发布语言交互的无人机控制模型

北航刘偲教授团队提出语言引导的细粒度无人机轨迹控制研究框架,定义Flow范式。采用模仿学习法让无人机响应指令,构建数据集和仿真评测基准,还提出协作策略和算法,实现真机部署。

量子位
新闻资讯7

豪掷30亿美元,OpenAI史上最大收购案!

彭博爆料OpenAI将豪掷30亿美元吞并AI编程工具Windsurf,这是其史上最大规模收购。Windsurf因模型无关设计等优势脱颖而出,此次收购或重塑AI编程市场格局。

新智元
新闻资讯7

速递|前字节Seed强化学习专家孙鹏加入星尘智能,将大模型后训练经验带到物理世界

9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。

AI前线