「算法基础」共找到 1107 篇相关文章
香港科技大学、Manycor开源空间大模型,超3000颗星
香港科技大学、Manycore联合开源空间大模型SpatialLM,用于处理3D点云数据。它结合点云特征提取、对齐和语言生成,实现高效转换。研究团队经多种尝试选定基于点的方法及Sonata编码器,还选Qwen2.5 - 0.5B为基础模型。
3D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32%
中科院自动化所提出BridgeVLA模型,将3D输入投影为2D图像并利用2D热图进行动作预测。它训练分两阶段,在多仿真基准和真机实验表现卓越,仅3条轨迹基础任务成功率达96.8%,真机性能提升32%。
英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限
学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。
独家 | CMU博士、UCSD助理教授黄碧薇创立「原识之智」,聚焦因果推理方向
AI科技评论独家获悉,CMU博士、UCSD助理教授黄碧薇创立上海原识之智科技有限公司,切入具身智能基础层相关的因果推理方向。当下大语言模型在符号世界表现出色,而机器人缺乏因果推理能力,原识之智项目已获顺为资本早期投资。
Medeo 教程:一次生成无脑抽卡不可取,真正的视频 Agent 应该啥样
本文介绍AI视频生成Agent Medeo 1.0版本,它支持短或超长提示词,泛化性好,多种垂类视频都能做。文中介绍其基础操作、展示案例和提示词,还剖析了能兼顾质量与灵活度的原因,目前产品在内测将全量上线。
对话VAST曹炎培:2秒才是3D生成本该有的速度
本文对话VAST首席科学家曹炎培,介绍其最新Smart Mesh功能,仅靠提示词或参考图,2秒内极速生成3D模型。Tripo P1.0重构AI 3D底层范式,实现原生三维空间概率生成。VAST获5000万美元A轮融资,今年将推UGC 3D平台。
阿里千问大模型换将,32岁林俊旸官宣告别
阿里巴巴高级算法专家、通义千问大模型负责人林俊旸宣布告别千问团队,此前一晚千问团队刚推出Qwen3.5轻量化模型且获马斯克点赞。此外,Qwen3.5核心贡献者Kaixin Li和通义实验室科学家Binyuan Hui也发文告别,几人去向未明。