「多LLM系统」共找到 6002 篇相关文章
一文看清AI、开源与商业的真正博弈,GOBI 2025圆满收官!
12月21日,GOBI 2025全球开源商业创新大会在北京举办。会上多位专家、学者围绕AI开源商业展开讨论。杜莹芬强调开源可持续需制度支撑;汪华称中国开发者迎AI开源创业黄金窗口;蒋涛梳理AI开源商业化新逻辑。
挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力
香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。
准确率腰斩!大模型视觉能力一出日常生活就「失灵」
EgoCross项目团队聚焦跨域第一视角视频问答评测,揭示现有MLLM在多场景泛化瓶颈。团队提出跨域第一视角视频问答基准EgoCross,经测试揭示模型短板,验证改进方法潜力,研究入选AAAI 2026且数据集等已开源。
不玩PPT拼实战!中国「具身军团」要在上海动真格了
即将于12月12日举行的「GDPS 2025全球开发者先锋大会」,代表上海具身智能生态全面跃迁。上海为具身智能产业提供场景、算力等支持,企业完成从概念到工业级成熟的蜕变,大赛将进行多赛道「实弹演习」。
智能流体力学青年学者论坛第28讲:伦敦城市大学Manolis Gavaises教授
智能流体力学青年学者论坛第28讲于2025年12月4日9点至12点在航空楼A110举办。多位学者分享成果,如Manolis Gavaises用机器学习建模多相流;方波李研究超临界流体湍流;陈杰石提出大涡模拟子网格模型等。
Jina AI创业复盘:AI团队的Scaling Law是什么
本文是对 Jina AI 创始人肖涵的访谈,复盘六年创业历程。他两次转型,最终聚焦搜索底座模型,公司被 Elastic 收购。他分享创业得失,认为团队聚焦、高效运营是壁垒,还给出未来创业者专注、找优秀人才等建议。
中兴发了一篇论文,洞察AI更前沿的探索方向
当大模型参数量冲向万亿级,AI 行业面临瓶颈。中兴通讯发布论文剖析困境,勾勒前沿方向。文中分析了 LLM 现状、架构瓶颈、AGI 争议等,还阐述了改进优化措施及下一代计算范式发展趋势,介绍了中兴的探索实践。
Meta刚刚开源的SAM 3D火爆全网,未来2D=3D。
近日AI圈热闹,Gemini、GPT、Grok相继更新,Meta虽未更新小羊驼,却发布开源3D模型SAM 3D。它能精确重建人或物体3D模型,有真实三维感知,有两模型,性能强,应用场景多。
英伟达炸裂业绩打飞“AI泡沫”,黄仁勋:云端GPU卖光了
英伟达财报超预期,盘后股价飙升,带动行业股票反弹。黄仁勋称云端GPU售罄,驳斥“AI泡沫论”。其业务多板块增长,不过毛利率回落,因业务结构转型。市场对AI投资热潮看法不一,黄仁勋称是“AI良性循环”。
32倍加速,58秒搞定720p视频!字节发布离散自回归框架,统一视觉生成和长视频生成
字节发布InfinityStar框架,将5秒720p视频生成时间从30多分钟缩至58秒,还支持多样任务。它基于对视频本质思考设计时空金字塔模型,将时空分离,通过多项技术优化,性能表现出色,不过也存在一些技术局限。