「多模型 Agent」共找到 11003 篇相关文章
破解机器人「慢半拍」难题:南洋理工解决VLA致命短板,动态世界断层领先
南洋理工大学NTU S-Lab团队提出DynamicVLA,解决主流VLA模型在动态场景下反应迟缓等问题。它从多层面设计,构建自动化数据体系和DOM Benchmark,在实验中多维度领先。
中国第一批没有论文的工科博士毕业了
国内推出实践型博士学位,不看论文,只认硬核实践产出。自去年9月以来,至少11人获此学位,分布多领域。这一制度由《学位法》推动,且清华创新领军工程博士如周鸿祎也适用。
本周六,2026崇礼论坛,俞敏洪、周鸿祎、姬十三、沙宝亮、储殷、吴世春都来!|甲子光年
2026年1月23 - 25日,2026崇礼论坛将在张家口崇礼区太舞小镇举行,主题为“向新而立”。开幕式有俞敏洪、周鸿祎等多位行业掌门人为AI定调,还有四大专场,各界大佬齐聚探讨AI多方面话题。
8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队
大模型下半场,后训练特别是强化学习成核心战场。潞晨云微调SDK上线,它是国内首个全面开放、且兼容Tinker范式的Serverless微调平台,为强化学习提供低成本解法,在易用性和成本上有优势。
并行扩散架构突破极限,实现5分钟AI视频生成,「叫板」OpenAI与谷歌?
近日,CraftStory 推出 Model 2.0 视频生成系统,凭借并行扩散架构破解视频时长难题,可生成长达五分钟视频。其由 OpenCV 创建者 Victor Erukhimov 创立,此次突破或为企业带来商业价值,还计划开发新模型。
北大、字节、中科院自动化研究所等提出图像并行生成新范式
北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。
ICIG 2025:共话图像发展新坐标
2025年10月31日至11月2日,第十三届国际图象图形学学术会议(ICIG 2025)在徐州举行,700余人参会。大会展示前沿成果,设多场论坛与赛事,专家认为其为领域发展注入新动力,巩固中国学术交流地位。
英伟达,全球首个5万亿美元公司诞生!「GPU帝国」超日本德国GDP
英伟达市值突破5万亿美元,成全球首家达此里程碑公司,超德国和日本GDP。黄仁勋预计2026年GPU销售额达5000亿美元。GTC大会围绕‘AI工厂’展开,英伟达在多领域布局,搭建庞大AI帝国。
小红书RecSys 2025最佳论文提名背后:破解视频时长预测难题
小红书推荐算法团队论文《Multi-Granularity Distribution Modeling for Video Watch Time Prediction via Exponential-Gaussian Mixture Network》在 RecSys 2025 获最佳论文提名。该文剖析视频时长预测难题,提出 EGMN 模型,线下线上验证效果佳。
超越AlphaFold 3!ProRNA3D搞定RNA蛋白互作,攻克癌症、病毒有了新武器
弗吉尼亚理工Debswapna Bhattacharya团队开源AI工具ProRNA3D - single,能仅靠单条蛋白质和RNA序列预测二者复合物三维结构,超越AlphaFold 3等工具,基于生物语言模型,有诸多应用价值,也有改进方向。