「论文分享会」共找到 3379 篇相关文章
多模态思维链如何重塑 AI 与短视频的未来
传统多模态模型在动态视频理解与复杂推理场景面临挑战,快手开源的 Keye-VL 模型在多模态思维链技术实现突破。文章解析其核心技术,分享在快手短视频社区的落地应用,还探讨了未来“Think with Video”的技术方向。
NeurIPS 2025 | 面向具身场景的生成式渲染器TC-Light来了,代码已开源
TC-Light 是中科院自动化所张兆翔教授团队研发的生成式渲染器,能对长视频序列重渲染,减少 Sim2Real Gap 及实现数据增强。它克服了时序一致性和计算开销挑战,性能优于现有技术,论文与代码已开源。
独家丨小鹏机器人团队“广招兵马”,原字节 Seed 陈杰已加入
AI科技评论独家消息,小鹏机器人团队正招人,原Seed强化学习大佬陈杰已加入。此前鹏行团队规模有过缩减,如今行业竞争加剧,其重又开启招兵买马。小鹏在机器人领域投入已久,何小鹏还表示会继续加大投入。
4位图灵奖得主布道,2大冠军机器人登台,“AI春晚”果然又高又硬
智源大会堪称“AI春晚”,规格高看点多。4位图灵奖得主分享观点,长跑冠军天工和拳击冠军宇树G1机器人秀技能。大会还发布“悟界”系列大模型,RoboOS 2.0与RoboBrain 2.0开源,多方探讨下一代AI发展路径。
让方程发现走向超大规模系统——《Predicting Dynamics of Ultra-Large Complex Systems by Inferring Governing Equations》精读笔记
论文《Predicting Dynamics of Ultra-Large Complex Systems by Inferring Governing Equations》提出Sparse Identification Graph Neural Network(SIGN),将方程发现工作流重新安排,在多类系统实验中展现可扩展性与长期预测能力,还在海表温度数据中恢复出共享动力学表达。
Kimi 大模型训推混部的稳定性与资源优化实战
月之暗面系统工程师黄维啸在 QCon 大会分享 Kimi 大模型训推混部实践。介绍了训推集群挑战,如故障多、资源利用低等,还阐述了全链路稳定性提升、资源高效利用及强化学习混合部署等方案。
语言反思>强化学习:伯克利新架构碾压传统RL
大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。
AutoResearch-LLM:让 Agent 接手 LLM 训练优化
本文是 LLM 微调 AutoResearch 落地实战。作者将电商场景 Qwen3 微调流水线沉淀成 Agent 驱动的三阶段框架,还分享踩坑经验。思路方法与平台无关,可类比到外部环境,适合关注 AI Coding 等的同学。
Jina AI创业复盘:AI团队的Scaling Law是什么
文章是Jina AI创始人肖涵的创业复盘。他率团队六年创业后将公司出售,期间两次转型,聚焦搜索底座模型。他分享创业经历、公司命名、业务调整等,还谈收购、模型竞争、未来创业方向及给创业者的建议。
ICLR 2026惊现SAM 3,分割一切的下一步:让模型理解「概念」
9月12日,匿名论文‘SAM 3: SEGMENT ANYTHING WITH CONCEPTS’登陆ICLR 2026,外界猜测出自Meta。SAM 3定义了可提示概念分割任务,性能比之前系统提升至少2倍,在多基准测试获SOTA成绩,但也有人质疑是旧概念包装。