「3D-Resampler 架构」共找到 3628 篇相关文章
MiniMax开源首个视觉RL统一框架,闫俊杰领衔!推理感知两手抓,性能横扫MEGA-Bench
MiniMax开源首个视觉RL统一框架V-Triune,由闫俊杰领衔。该框架通过三层组件设计和动态IoU奖励机制,让VLM能联合学习推理和感知任务。还开发Orsta模型系列,在MEGA - Bench表现出色,且MiniMax多模态布局动作多。
奥特曼震撼预言:6个月后,ChatGPT将彻底接管你的人生
OpenAI首席执行官奥特曼预言,未来6个月,下一代AI将彻底看懂用户,实现人机共生。当前OpenAI的Chronicle和Dreaming V3分别在屏幕上下文与对话合成方面有进展,且几乎整个AI行业都在押注记忆方向。
押注Agent,林俊旸带着新公司杀回来了
前阿里Qwen负责人林俊旸创办Pragmatik Labs/语用科技,研究跨数字与物理世界的下一代agent。红杉中国、高榕创投领投,腾讯等跟投。其目标是用agent实现终极生产力,有独特技术底色与愿景。
2026 中国 AGI 创新影响力机构 TOP 30 征集启动!
今年AI行业关注点重回模型与模型公司,开源逼近闭源前沿,C端用户规模上涨。在此环境下,极客公园启动2026中国AGI创新影响力机构TOP 30征集,从多维度评选,给出申报、评审及结果公布时间。
花几百万开发布会结果无人问津?或许你该看看这个…
2025年科技公司意识到技术需被看见。发布会等传统传播方式遇冷,科技内容融入生活日常。抖音在科技传播竞争中站到中央,通过创作者视频让技术直观呈现,解决企业从产业到大众认知转化难题。
ClawdBot传疯了!视频教程来了
外网疯传的ClawdBot由开发者Peter Steinberger开发,能通过多平台交互干活。介绍其技术架构、两种设置方式、成本,还有安全设置、测试方法、进阶功能、使用场景及硬件选择等。
前谷歌研究员发文:算力崇拜时代该结束了
前谷歌大脑研究员 Sara Hooker 发文指出,过去十年 AI 创新依赖算力,但如今持续扩展训练计算资源效率极低,收益递减。她探讨了影响算力回报率的因素,批判 Scaling Law,并提出未来创新方向。
「AI 100」榜单启动招募,AI产品“年会”不能停丨量子位智库
2025年国内AI产品关键词频现,各有代表性产品。量子位智库2025年度「AI 100」榜单开启招募,分三大板块,用定量与定性结合评估体系,还公开AI产品知识库。
DeepSeek-OCR是「长文本理解」未来方向吗?中科院新基准给出答案
DeepSeek-OCR的视觉文本压缩技术降低长文本处理成本,中科院自动化所等团队推出VTCBench基准测试评估模型视觉认知,含三大任务及衍生版本,测试结果有‘U型曲线’,还评测多种尖端模型。
宇树:开源机器人世界大模型!
宇树开源世界模型 - 动作架构UnifoLM - WMA - 0,它属UnifoLM系列,适配多机器人本体。真机部署表现出色,预测与实际操作吻合。官方介绍训练策略,代码开源后GitHub获100 + Star。