「爆破性研究」共找到 2334 篇相关文章
AAAI2025、POF | 西湖大学冯浩东、范迪夏等:如何在不准确物理信息和部分观测下利用物理信息建模流体力学系统
此文章聚焦在不准确物理信息和部分观测下利用物理信息建模流体力学系统问题。提出RPLPO与PIPO算法,前者解决部分观测模型泛化性,后者解决不准确物理信息在部分观测中的应用,实验验证了算法有效性。
舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿
本文介绍新加坡国立大学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。
DeepSeek-R1超级外挂!“人类最后的考试”首次突破30分,上海交大等开源方案碾压OpenAI、谷歌
上海交大联合深势科技团队发布新研究,在“人类最后的考试”(HLE)上获32.1分创纪录。团队推出工具增强推理智能体X - Master、多智能体工作流系统X - Masters并开源,方案表现优于OpenAI、谷歌相关模型。
The Batch: 843 | Meta 的智能眼镜愈发清晰
Meta公布Aria第二代智能眼镜平台,其亮点在于增强现实等研究领域能力。该眼镜体积小、续航久,内置多传感器,能实时解读多方面信息。研究人员今年晚些时候可获设备,其数据或为多领域开辟新路径。
思维锚点:破解LLM Reasoning黑箱的关键句
文章提出思维锚点概念,指推理轨迹中影响后续步骤和答案的关键句。开发三种归因方法,系统论证高级组织句影响力更大,锚点主导错误修正。研究为理解LLM推理机制开辟新途径,开源工具支持可视化分析。
告别 CVE?欧洲漏洞数据库 EUVD 正式上线
欧盟网络安全局推出欧洲漏洞数据库(EUVD)测试版,与CVE并行独立运作,旨在提升欧盟内部漏洞处理协调性与透明度。CVE虽为国际标准,但美国政治动向引发其稳定性担忧,EUVD可作备用且有增强功能。
大模型结构化推理优势难复制到垂直领域!最新法律AI评估标准来了,抱抱脸评测集趋势第一
多个机构研究人员联合发布全新多语言法律推理基准数据集LEXam,它含4886道题,每道长篇题有答案和推理路径。研究显示现有大模型应对法律推理难,LEXam引入评估新模式,还对不同模型做了测试。
ACL2025 | 传统符号语言传递知识太低效?探索LLM高效参数迁移可行性
中科院自动化所谭宇乔等研究跨规模大模型参数知识迁移(PKT)可行性。指出传统符号语言传递知识低效,LLM 模仿此范式也有局限。提出新 Pre - Align PKT 范式,实验分析 PKT 效果,揭示神经不兼容性致其失败。
谷歌突袭发布AI应用,无需Wi-Fi、手机就能跑大模型!网友实测两极分化
谷歌推出 Google AI Edge Gallery 应用,可在 Android 设备离线运行 AI 模型。它有本地运行、智能选模等特点,响应快且隐私性好。不过网友实测评价不一,有人认为它是旧技术包装,还被指比 Core ML 落后。
代码、多模态检索全面登顶SOTA!智源BGE向量模型三连击,并全面开放
检索增强技术在代码及多模态场景作用大,向量模型是关键。智源研究院联合高校研发三款向量模型BGE - Code - v1、BGE - VL - v1.5、BGE - VL - Screenshot,登顶多领域测试基准,已全面开放助力研究与应用。