存在论」共找到 8305 篇相关文章

产品应用7

R2没来,却等来综合性能更优的DeepSeek R1T2

抱抱脸热门排行榜出现R1变体模型DeepSeek-TNG-R1T2,构建于多个父模型之上,智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模型对比的选择建议。

PaperAgent
算法论文7

Meta最新大模型RL微调:线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习大模型微调中的有效性,对比离线、半线和线训练范式。半线和线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent
算法论文7

LLM加RL遭质疑:故意用错奖励,数学基准也显著提升,AI圈炸了

华盛顿大学等机构文引爆AI界,其发现用虚假奖励训练Qwen2.5-Math-7B模型,也能提高MATH - 500成绩。虚假奖励对Qwen模型有效,但其他模型上有限,凸显RLVR有效性与模型能力有关。

机器之心
算法论文8

不再止步于自然语言!PhiZero让世界模型学会「物理语言」

PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,多基准测试中表现领先,为AI理解物理世界开辟新通道。

机器之心
推荐文章7

深度解读|LLM Wiki 的工程实践,从 AI Coding、Obsidian 到 RAG 协同。

文章介绍 LLM Wiki 工程实践。包括为 AI Coding 创建知识地图,指导 Agent 加载上下文; Obsidian 构建知识体系,有插件和自定义 Agent 两种方法;还分析其与 RAG 关系,指出可融合互补,不要过度神话 LLM Wiki。

AI大模型应用实践
算法论文8

2026文解读,ASAHI:自适应切片助力小目标检测,速度提升25%、精度创新高

高分辨率航空图像小目标检测难,传统检测器表现差。2026年4月都灵理工大学团队提出ASAHI,用自适应切片框架,VisDrone2019上mAP50达56.8%,推理速度比SAHI提升20 - 25%,还介绍了实战代码等。

机器学习AI算法工程
开源动态8

全新OCR将图片变代码无损重绘!华中科大&小红书发布3B模型,图形重建超越Gemini 3 Pro

华中科技大学与小红书联合推出MOCR,提出「解析一切」新范式,将文档图形升级为「一等解析目标」。它解决传统OCR短板,文档解析和图形重建表现出色,还革新评估方法,代码和模型已开源。

量子位
推荐文章7

一个强化学习信仰者的十年|甲子光年

本文讲述朱哲清强化学习领域的十年历程。他从斯坦福到Meta再创立Pokee AI,逆势押注强化学习。虽面临诸多质疑,但随着InstructGPT等出现,强化学习逐渐被认可,他致力于构建新一代AI Agent。

甲子光年
算法论文8

航空学报 | 西工大余囿铮、寇家庆等:基于生成对抗网络的通航飞行器气动布局设计方法

传统飞行器气动布局设计依赖专家经验,方案多样性受限。本文基于改进的生成对抗网络,提出端到端气动布局生成框架,以机翼和通航飞行器为对象研究,验证了其创新飞行器设计方面的潜力。

力学与人工智能
产品应用8

连肝12小时!一轮狂刷1500篇文,写4.2万行代码,AI科学家卷疯科研圈

Kosmos是一款全程无需人类插手的AI科学家,最长能连续工作12小时,平均一次研究读1500篇文、写4.2万行分析代码,79%研究结果可被人类复现,已多领域有7个真发现。

量子位