原子级槽位迁移」共找到 1204 篇相关文章

开源动态8

准确回答视频细节!11B模型挑战视频理解「证据」任务,开源可商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据能力,架构设计独特,采用Apache2.0开源许可。

量子位
算法论文8

π0.7来了!涌现出组合泛化、跨本体迁移能力,VLA又行了?

具身赛道玩家 Physical Intelligence 发布新模型 π 0.7,它展现出组合泛化和跨本体迁移能力,还能通过知识蒸馏学会优化技巧。其强大源于杂数据和细提示,未来有望解决复杂任务。

机器之心
新闻资讯8

码农只剩6个月?Anthropic CEO断言AI接管一切代码,爆冲诺奖智能!

达沃斯论坛上,Anthropic的Dario Amodei和谷歌DeepMind的Demis Hassabis就AGI未来展开对话。Dario预测AI 6 - 12个月接管软件工程师工作,2026 - 2027年模型达“诺奖”;Demis认为2030年前有50%概率实现AGI。

新智元
算法论文8

光场显微飞跃AI时代!清华等首提SeReNet:毫秒高分辨光场三维重建

SeReNet是物理驱动的自监督三维重建网络,能毫秒实现高保真、高分辨光场三维重建,摆脱对标签数据依赖。它全链路建模应对复杂干扰,在多实验展现价值,推动生物成像技术发展。

新智元
算法论文8

谁说Scaling Law到头了?新研究:每一步的微小提升会带来指数增长

很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但新研究发现,模型单步准确率的微小提升能使完成任务长度指数增长,还探讨了长程执行能力的衡量及影响因素。

机器之心
开源动态8

Transformer开始构建三维世界:开源模型几张图片秒生成可探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量图片就能秒生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心
开源动态8

GitHub热搜,腾讯黑科技炸场!PhotoMaker:10秒定制真人头像,百万开发者已疯狂

PhotoMaker是腾讯ARC实验室联合南开大学发布的人像图像生成项目,荣膺CVPR 2024。它能秒生成高质量人像,有高保真ID嵌入等机制,V2版升显著,适用多场景,比同类项目优势明显。

小华同学ai
开源动态8

混元3D世界模型1.0 lite版本发布,消费显卡就能跑

腾讯混元3D世界生成模型HunyuanWorld 1.0发布即开源,可在消费显卡运行,还能兼容传统CG管线。它分层实现3D生成,通过量化等技术降低显存开销,与同类模型相比优势明显。

量子位
产品应用7

支付宝 AI 出行助手高效研发指南:4 人团队的架构迁移与提效实战

本文介绍支付宝AI出行助手研发历程,其集成多种出行功能,基于xUI + KMP框架搭建。分享研发实践、挑战与策略,如迁移基础能力、卡片生态,适配标准框架,还提及KMP应用及数据度量体系,取得业务和研发效能成果。

阿里云开发者
开源动态8

腾讯混元世界模型1.1开源:单卡秒重建3D世界成为现实

腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升版。新增多视图及视频输入,单卡可部署,秒创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。

AIGC开放社区