科研LLM」共找到 1313 篇相关文章

新闻资讯8

商汤分拆了一家AI医疗公司,半年融资10亿,剑指“医疗世界模型”

商汤分拆AI医疗公司,半年融资10亿。其以自研“大医®”为核心构建医疗世界模型,形成闭环。推出智慧医院方案,临床、决策、患者端等多方面落地成果丰富,还布局海外市场,未来想让AI从文本到模拟决策。

量子位
新闻资讯8

英伟达XR-AI Scientist亮相:丛乐、王梦迪团队把“AI科学家”送进实验室|甲子光年

10月底英伟达上线NVIDIA XR - AI平台,丛乐、王梦迪团队联合英伟达等推进其在实验室科学融合应用,涉及LabOS和CRISPR - GPT两项技术突破,还推出LSV Benchmark标准及排行榜,有望改变XR现状。

甲子光年
算法论文8

解决Agent幻觉:HaluMem精准定位记忆系统的“说谎”环节!

近年来,LLM和Agent在记忆管理上存在挑战,现有评估方法无法定位幻觉来源。论文提出HaluMem评估基准,通过三大任务和两个数据集揭示记忆系统幻觉行为,为开发可靠记忆机制提供指导。

深度学习自然语言处理
开源动态8

BigBang-Proton: 自回归基座模型统一语言、科学和物质世界

超对称公司发布新版基座模型 BigBang - Proton,实现多学科问题与 LLM 统一预训练和推理,挑战主流 AGI 技术路线。它有三项创新,在多专业学科任务表现出色,还提出宇宙尺度压缩构想。

InfoQ
开源动态8

字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名

现代LLM依赖显式文本生成训练“思考”,未充分挖掘预训练数据潜力。字节Seed团队联合多家机构推出循环语言模型Ouro,将推理能力构建到预训练阶段,实现参数效率提升,还降低了有害性。

机器之心
推荐文章7

“谈故障色变”到有章可循:美图 SRE 故障应急与复盘实践

在 InfoQ 举办的 QCon 全球软件开发大会上,美图高级运维经理石鹏分享美图 SRE 团队故障应急与复盘实践,探讨故障应急各环节,剖析故障本质与原因,还交流 AIOps、LLM Ops 等技术。

InfoQ
算法论文8

ACL 2025 | GALLa:给代码大模型装上“透视眼”,看懂程序的“骨架”!

蚂蚁集团与上海交大合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入大模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。

PaperAgent
新闻资讯8

刚刚,GPT-5首次通过「哥德尔测试」!破解三大数学猜想

GPT - 5首次通过「哥德尔测试」,破解三大组合优化猜想。研究由海法大学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还推导出不同解法,标志AI从「学习数学」迈向「做数学」。

新智元
算法论文7

“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%

多模态长文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。

PaperAgent
算法论文8

ICCV 2025 | ECD:高质量合成图表数据集,提升开源MLLM图表理解能力

科研等领域图表是信息核心载体,先进开源MLLMs在高难度图表理解测试准确率低。本文提出ECD数据集,规模大、质量高、风格多样,还设计合成流水线与评测基准ECDBench,为开源MLLM提供支持。

机器之心