相机参数预测」共找到 1134 篇相关文章

开源动态8

给机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心
开源动态8

字节跳动开源视频生成模型Alive:12B参数,个人电脑也能跑

字节跳动开源视频生成模型Alive,12B参数,支持四种模式,硬件门槛低。在评测中表现出色,技术架构精心设计,解决音视频同步等问题,虽有小瑕疵,但更适合普通玩家。

AI工程化
产品应用8

Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o

Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。

新智元
新闻资讯7

马斯克曝光Grok 5!1.5万亿参数,偷师Cursor狂练编程

5月25日凌晨马斯克官宣,1.5万亿参数Grok V9-Medium训练完成,2 - 3周后发布。训练灌入大量Cursor编程数据,编程能力将大幅提升。此前v8 - small年底前开源,马斯克编程赛道布局全面摊牌。

新智元
算法论文8

五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来

近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。

机器之心
新闻资讯7

个人开发者训400亿参数大模型:分布式算力,DeepSeek架构,3090单卡部署

Nous Research推出Psyche Network,可整合全球算力训练AI。它基于Deepseek的V3 MLA架构,有DisTrO优化器等技术,能让个人和小团体创建大规模模型,还实现40B参数LLM预训练。

量子位
推荐文章8

让外部知识“长入”模型:动态化与参数化 RAG 技术探索

检索增强生成(RAG)成大语言模型利用外部知识主流范式,但传统方法将其当黑箱,忽略动态需求和机制鸿沟。艾清遥博士介绍动态化和参数化检索增强技术,可提升准确性与适应性,减少计算开销。

AI前线
算法论文8

小红书RecSys 2025最佳论文提名背后:破解视频时长预测难题

小红书推荐算法团队论文《Multi-Granularity Distribution Modeling for Video Watch Time Prediction via Exponential-Gaussian Mixture Network》在 RecSys 2025 获最佳论文提名。该文剖析视频时长预测难题,提出 EGMN 模型,线下线上验证效果佳。

机器之心
算法论文8

刷榜多元时序预测,性能波动0%!打破CI/CD二元对立 | ICLR'26

在多元时间序列预测领域,长期存在通道依赖(CD)与通道独立(CI)路线之争。浙江财经大学团队提出CPiRi框架,结合时空解耦架构与置换不变正则化策略,解决范式矛盾,取得优异效果。

新智元
开源动态7

3.5k星星!用AI推演、预测未来,这个开源多体智能引擎做到了。

文章介绍开源多体智能引擎MiroFish,它是基于多智能体技术的AI预测引擎。用户提供种子文件、下达指令,它能构建数字沙盘,让AI智能体互动演化,可用于企业公关等场景,还给出推演流程。

开源AI项目落地