「LLM框架」共找到 2428 篇相关文章
效果、性能双突破,快手OneSug端到端生成式框架入选AAAI 2026
查询推荐是电商搜索关键功能,传统方法有局限。快手提出OneSug端到端生成式框架,统一多阶段,提升效果与效率,成果入选AAAI 2026,已在快手电商全量推广,显著提升多项指标。
当世界模型不止「视频」该如何评估?WorldLens提出实用化评估新框架
生成式世界模型在多领域进展显著,但评估存在局限。WorldBench 团队构建 WorldLens 评测框架,从五个维度评测开源世界模型,其评测 EvalKit 已公开,可暴露模型能力边界与失效模式。
视频生成太慢?英伟达、谢赛宁等发布TMD框架,实现70倍加速
大规模视频扩散模型采样效率低,应用受限。英伟达联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。
POF | 西北工业大学宋家豪、张伟伟等:一种基于伴随方法的物理信息神经网络预处理框架
物理信息神经网络(PINNs)在正问题中的病态是其应用于复杂工程问题的局限。该研究设计针对损失函数的预处理框架,通过降低PDE系统条件数缓解PINNs病态,还引入伴随方法解决网络参数梯度缺失问题。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
智谱发布GLM 4.5,不仅开源模型还把训练框架也开源了
智谱AI发布GLM 4.5,不仅开源模型,还开源整套后训练基础设施。模型规格亮眼,性能也超越qwen 235b。其开源的训练框架slime专为强化学习扩展设计,完整工具链支持多种模型。
与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本
NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。
Clawdbot国产芯片适配完成!清华特奖出手,开源框架直接一键部署
Clawdbot(现名OpenClaw)超火,不到一周GitHub达12万Star。但使用成本高,新开源的国产框架玄武CLI可让其在本地运行,适配国产芯片,还能降低成本,避免信息泄露。
马斯克亲自点名Karpathy迎战Grok 5!别神话LLM,AGI还要等十年
OpenAI创始元老Karpathy称AGI仍需10年,指出实现AGI难题多。马斯克点名其与Grok 5编程大战被拒。Karpathy还谈及LLM、强化学习、智能体等观点,主张合理看待AI发展。
老黄力推的 Physical AI,有人用开源框架打通了硬件的最后一道关
巨头加速布局Physical AI,全球AI云平台涂鸦智能用TuyaOpen开源框架破局,为开发者提供入场券。它可拆技术墙、通生态孤岛、跨商业化黑洞,还让开发者打造多样AI硬件,助力商业化。