「Build 2025 大会」共找到 1211 篇相关文章
全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025
7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务基准上超越顶尖闭源模型,还具备体系化技术创新。未来将持续开源,打造更懂科学的AI助手。
88%的公司在用AI,但只有39%吃到真金白银?麦肯锡2025 AI报告来了!
麦肯锡《The State of AI in 2025》显示,88%受访企业用AI,但仅39%获财务回报。多数企业AI在试点,Agent落地少,高绩效企业享红利,AI岗位影响招聘结构。
C端热战,B端暗涌:大模型真正的战场才刚刚开始 | 《中国大模型落地应用研究报告 2025》正式发布
InfoQ研究中心联合中欧AI与管理创新研究中心发布《中国大模型落地应用研究报告2025》,从驱动因素、C端产品现状到B端落地现状,勾勒大模型应用转折期的图景,分析应用难的原因及各端现状。
超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官
5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。
原来Veo 3早有苗头!人大联合值得买科技在CVPR 2025提出全新「图像到有声视频」生成框架
中国人民大学与值得买科技团队在CVPR 2025提出JointDiT框架,可从静态图像生成同步音视频。此研究定义图像到有声视频生成新任务,解决音视频融合难题,实验显示其效果优,还将拓展至四模态建模。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025
KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。
AI在实时视频里秒“剪”出你想要的部分!输入文字/图/视频片段,它都能秒懂|ICCV2025
最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、图、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。
当亚马逊云科技拿到“麦克”,一年的云计算叙事都被改写了
2025亚马逊云科技re:Invent大会上,CEO Matt Garman围绕Agentic AI落地发布系列新品。其认为落地需四大支柱,亚马逊云科技带来如芯片、模型等成果,还强调私有数据及开发者工具重要性,多个企业已实践应用。
挤不动的世界机器人大会上,自变量秀出了真·通用具身智能
2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。