「SFT训练集」共找到 2534 篇相关文章
DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测
文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。
当200位具身从业者被拉进同一个屋子
量子位等联合发起沙龙,近200位具身从业者探讨具身智能从实验室走进物理世界的问题。乐聚工程师指出具身数据瓶颈,蚂蚁灵波郑可成介绍模型,上海交大李永露分享评测基准,圆桌对话探讨数据挑战与破局路径。
米哈游蔡浩宇AI公司首个视频模型曝光了
米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过多模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。
关于具身智能「触觉」,你想知道的都在这篇综述里了
本文由香港科技大学(广州)熊辉教授团队牵头,联合多所高校,全面梳理截至2026年第一季度具身智能触觉前沿研究。介绍触觉重要性、多模态触觉融合流程、全景蓝图,指出面临挑战并展望未来。
叫板华尔街之神!诺奖得主在谷歌眼皮底下组队炒股,CEO亲自叫停
AlphaGo之父Hassabis曾在谷歌眼皮底下拉20个顶尖研究员训练高频交易AI,想挑战华尔街量化之神,与贝莱德探讨合作。后因谷歌CEO叫停,项目停摆。不过如今AI+金融正加速发展。
nnU-Net:医学图像分割的自适应自动化框架
德国癌症研究中心团队提出 nnU-Net 自配置医学图像分割框架,能根据数据集特征自动推导预处理、网络拓扑等策略获稳健分割基线。文章介绍其原理、优缺点、评测案例及 Python 代码实现。
王兴兴署名,宇树机器人春晚之后又进化了:单个策略就能学习各种极限动作
春晚上,宇树机器人展现高动态、高协同的全自主集群控制技术。现在,多机构提出 OmniXtreme 通用策略,可执行各种极限动作。该框架分两阶段,经测试在仿真和现实中表现出色,打破了泛化壁垒。
Nature子刊:攻克医疗器械「看不清」难题,赋予自动驾驶视觉
MicroSyn-X首创无需真实数据的AI合成影像技术,让机器在无标注虚拟X光中学会追踪微型手术器械,突破医疗数据稀缺瓶颈,为自动化微创手术提供新路径,且代码和数据已开源。
社区供稿丨Ring-2.5-1T,思更深,行更远
今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。
首个大规模记忆湖发布,AI Infra跑步进入“记忆”时代
LLM是AI的“第一大脑”,记忆平台是“第二大脑”。当前AI企业应用进入生产力时代,竞争聚焦“隐性知识”记忆化。质变科技发布MemoryLake,具备多方面能力,在性能上优势显著,已服务众多用户和企业。