「超树建模」共找到 2340 篇相关文章
英伟达下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽
在周二的AI基础设施峰会上,英伟达宣布推出专为超100万token长上下文推理设计的Rubin CPX GPU。它将与其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。
快手在 AI 上,渐入佳境
文章介绍快手多模态大模型 Keye-VL 1.5,参数 8B 适合中小企业。它侧重短视频场景,视频理解能力强,能与业务结合,提升推荐等场景效率。还详述其架构、预训练、后训练及训练架构优化等技术细节。
AAAI-26投稿量爆炸:近3万篇论文,2万来自中国,评审系统都快崩了
AAAI - 26主技术轨道接收近29000篇投稿,近20000篇来自中国。投稿作者超75000人,虽会剔除未达标稿件,仍约23000篇进入评审,是AAAI - 25近两倍。AAAI采取措施保障评审质量。
智谱AI发布桌面Agent,轻松训练 AI数字员工
智谱AI发布ComputerRL自主桌面智能框架,旨在让AI像人一样用电脑。它融合API与GUI,采用分布式训练,引入Entropulse解决探索衰减。在OSWorld测试中表现亮眼,虽有视觉感知等挑战,但意义重大。
唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力
大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。
GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!
一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。
视频生成 vs 空间表征,世界模型该走哪条路?
随着生成模型和潜在表征技术发展,业界探讨世界模型技术路线。是像素级视频预测模拟未来场景可靠,还是潜在空间抽象表征高效?Goole DeepMind的Genie 3发布,再次引发讨论,分歧也从理论走向应用。
SceneGen: 单图像驱动的多资产3D 场景生成
上海交通大学提出SceneGen框架,可从单张场景图像及其对应目标掩码中,同时生成带有几何结构与纹理的多个3D资产。它一次前向传播即可完成生成,在效率与稳健性上优于现有方法,虽有局限但应用潜力大。
智能体新范式Chain-of-Agents,多项任务新SOTA
论文提出Chain-of-Agents (CoA) 范式,结合多智能体系统与工具集成推理优势。通过多智能体蒸馏和智能体强化学习训练智能体基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。
Sora没做到的,LongVie框架给解决了,超长视频生成SOTA
视频生成近年进步大,但生成超1分钟高质量长视频仍难。上海人工智能实验室等机构提出LongVie框架,解决时序不一致和视觉退化问题,还推出评测基准LongVGenBench,该框架在多项指标达SOTA。