「多模态智能体」共找到 4168 篇相关文章
英伟达2026奖学金,8位华人博士统治榜单!人均6万美金
2026 - 2027年度英伟达研究生奖学金名单揭晓,10位获奖者中华人学者占8席。该奖学金提供最高6万美金科研经费与暑期实习机会。研究方向涵盖神经渲染、AI安全等,体现英伟达关注具身智能和AI安全。
小扎“亿元俱乐部”车门焊死!被曝冻结招聘,禁止内部人员流动
Meta超级智能实验室被曝冻结招聘,禁止员工跨团队调动。此前Meta大举招人,现因新老员工矛盾、AI部门重组及市场对“AI泡沫”担忧等因素调整战略,虽AI投资有收益,但仍需评估。
上海AI实验室发布『书生』具身全栈引擎,推动机器人大脑进入量产时代 | WAIC 2025
上海AI实验室发布『书生』具身全栈引擎Intern - Robotics并开放,它有一脑多形、虚实贯通、训测一体等创新。还启动‘具身智能光合计划’,15家企业机构已加入,助力解决行业难题,推动具身大脑量产。
内部爆料:Alexandr Wang上任第一把火,Meta大模型闭源
据知情人士,Meta新成立的超级智能实验室正讨论重大决策,高层对AI模型是否开源存分歧。Meta曾因性能问题延迟Llama 4版本,现完成Behemoth训练却因不佳延迟发布,还探讨放弃它开发闭源模型。
从刮胡子机器人到双臂神技!这家具身独角兽引爆亿级美元融资热潮
具身智能大热,Generalist AI展示「拂晓」仿人自适应机器人完成高难度任务。日前,非夕科技宣布完成C轮亿级美元融资。该公司由前DeepMind科学家创立,获英伟达投资,其机器人在多领域有应用。
千问 APP 再更新:为什么说「聊天」并不是 AI 产品的终点?
当前AI市场进入场景战役阶段,头部玩家都在去聊天化。千问APP此次升级,可在同一界面内完成办公场景从需求到成品的全流程,还覆盖多种模板,引入智能编辑器,是务实且有意义的探索。
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案
随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。
奥特曼和量子计算奠基人讨论GPT-8
奥特曼在节目中与量子计算奠基人戴维・多伊奇就AI能否发展成有意识的超级智能产生分歧。奥特曼搬出GPT - 8举例试图说服对方,引发网友对AGI定义标准的讨论。
从「对口型」到「会表演」,刚进化的可灵AI数字人,技术公开了
快手可灵团队让数字人从「对口型」进化到「会表演」,全新数字人功能在可灵平台公测。技术报告Kling - Avatar解析背后技术路径,设计多模态两阶段生成框架,实验显示其在多方面领先竞品。