「3D空间智能」共找到 5348 篇相关文章
专门收购和孵化无聊产品,年收入 3 亿美金的 Tiny 给了些启发
Tiny 通过收购孵化不起眼但赚钱的产品,成年收入 3 亿美金的控股公司。联合创始人 Andrew Wilkinson 分享创业见解,如选有利润空间的细分市场,初期选能快速获正反馈的生意,还谈到收购、管理等多方面经验。
独家:逐际动力前COO张力加入具身智能大脑初创企业BeingBeyond|甲子光年
「甲子光年」独家获悉,逐际动力前COO张力今年四月初加入具身智能大脑初创企业BeingBeyond。该公司聚焦模型算法,其Being - H系列模型成果突出。张力加入或使公司向可规模化运转转变。
信息量爆炸!OpenAI内部路线图首次全曝光,首席科学家亲口承认:超级智能10年内到来
OpenAI宣布重组完成后,Sam Altman和首席科学家Jakub Pachocki直播公开内部路线图,称深度学习或10年内实现超级智能,还公布了AI研究目标与时间线,涉及产品、基建等多方面规划。
谷歌开源Gemma 3n:2G内存就能跑,100亿参数内最强多模态模型
本周五凌晨,谷歌正式发布、开源全新端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在多方面实现质量提升。
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用
近年来大语言模型在长篇视觉叙事中潜力卓越,但长视频剪辑仍难控制。中科大等团队开源工作从系统工程视角研究多模态智能体在长视频编辑中的机制,重构剪辑管线,找到症结并给出解决办法。
还是谷歌懂程序员?Demis 采访首提“氛围编程”,Gemini 3 彻底戒掉“爹味”说教
谷歌连发产品,Gemini 3 余温未消又推出 Nano Banana Pro。Google DeepMind CEO Demis 与团队副总裁对话谈其细节,包括降低运行成本、调整“人设”、提出“氛围编程”,还认为 AGI 到来需 5 到 10 年及研究突破。
vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼
vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。
不让“猪队友”拖后腿!哈深新作 AgentDropoutV2,专治多智能体“传话游戏”翻车现场
多智能体系统中,常有agent出错带偏整体。哈工大联合阿里提出AgentDropoutV2,测试时介入,设‘质检员’审核输出,结合失败案例构建‘避坑指南’,在多测试中显著提效,泛化性强。
手机AGI助手还有多远?移动智能体复合长程任务测试基准与调度系统发布
上海交大与澜舟科技研究发现现有移动端GUI智能体处理复合长程任务能力不足,提出UI - Nexus测试基准和Agent - NEXUS调度系统,经实验能提升任务完成率,也为AI原生操作系统建立雏形。
WebAssembly 3.0 发布,64 位内存、垃圾回收全都有,先别激动,组件模型还没做完!
WebAssembly 3.0 发布,有 64 位内存、垃圾回收等特性,但备受期待的组件模型未完成。虽未迎来‘Docker 时刻’,但服务器端生态有进展,不少平台已实现‘类组件’能力。