推理质量评估」共找到 3139 篇相关文章

算法论文7

Agentic-KGR:通过多智能体强化学习实现知识图谱的协同演化

文章指出静态知识库有覆盖缺失、时效滞后、建用分离问题。介绍 Agentic - KGR 创新点,如动态 schema 扩展等。实验显示其在图谱抽取和下游 QA 任务有提升,还呈现训练动态和图谱质量可视化结果。

PaperAgent
开源动态8

原生3D-VAEs,1536³三维分辨率,清华与微软TRELLIS 2开启3D全能生成新纪元

清华与微软团队推出TRELLIS 2系统,用全新O-Voxel表示法,1分钟生成1536³分辨率3D资产。它解决拓扑灵活性与存储效率矛盾,结合SC-VAE和流匹配模型,在多方面超越现有模型,还能适应不同场景。

AIGC开放社区
算法论文8

VGGT4D:无需训练,挖掘3D基础模型潜力,实现4D动态场景重建

香港科技大学(广州)与地平线研究团队提出 VGGT4D,无需训练,通过挖掘 Visual Geometry Transformer 注意力层运动线索,在动态物体分割等任务表现优异,为 4D 重建提供新思路。

机器之心
算法论文8

Nature重磅!清华团队揭秘大模型新规律:告别参数内卷,智能密度每3.5个月翻一番

清华和面壁智能团队研究揭示大语言模型进化的致密律,指出为获同等智能,模型参数量呈指数级下降,最大能力密度约每3.5个月翻一番,还探讨模型压缩、边缘智能等内容。

AIGC开放社区
产品应用8

真正能离线跑的完全开源翻译工具

Argos Translate是用Python写的开源离线翻译引擎,底层靠OpenNMT,推理用CTranslate2。可当库、命令行、桌面软件用,模型是本地zip包,不联网也能用。支持主流及小众语言,有多种使用方式。

GitHubStore
推荐文章8

游戏研发中的 AI 转型:网易多 Agent 系统与知识工程实践

本文整理自网易游戏高级技术经理林香鑫分享,其团队通过代码知识谱图构建、多 agent RAG 召回等技术打造超级助手,在多业务场景落地效果好。还介绍知识工程、多 Agent 赋能代码编写、AI 审查等实践及未来展望。

AI前线
算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
开源动态8

3A大作!阿里ROLL团队从基建->算法->机理,推动RL4LLM全栈协同优化

阿里巴巴ROLL团队联合高校推出「3A」协同优化框架,推动「强化学习用于大语言模型(RL4LLM)」迈向新范式。Async架构提升GPU利用率,AsyPPO降低计算资源消耗,Attention机制提升训练效率与可解释性。

机器之心
开源动态8

BigBang-Proton: 自回归基座模型统一语言、科学和物质世界

超对称公司发布新版基座模型 BigBang - Proton,实现多学科问题与 LLM 统一预训练和推理,挑战主流 AGI 技术路线。它有三项创新,在多专业学科任务表现出色,还提出宇宙尺度压缩构想。

InfoQ
算法论文8

更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画

香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。

AIGC开放社区