「SFT训练集」共找到 2530 篇相关文章
Meta 开源 Brain2Qwerty v2:非侵入式脑机接口语句解码准确率达到 61%
Meta 近日开源非侵入式脑机接口系统 Brain2Qwerty v2,能将人脑想法解码为完整语句,平均单词识别准确率达 61%,远超其他非侵入式方案。其采用三阶段深度学习模型,代码和训练数据已公开。
80万条数据揭示隐患:AI正在「污染」病历,你的诊疗数据可能越来越不靠谱
新加坡国立大学等机构团队研究显示,AI生成临床文本用于训练新模型,会使病理信息在数据迭代中消失,降低医疗AI诊断可靠性。研究分析80多万条合成数据,还提出缓解方法。
Meta开源史上最强语音“基座模型”:一口气支持1600+种语言
Meta AI FAIR团队发布Omnilingual ASR模型套件,能为超1600种语言提供自动语音识别能力。它引入新架构提升性能,改变引入新语言范式,还发布相关数据集和模型,与全球伙伴合作。
字节发了个机器人全能大模型,带队人李航
字节推出Seed,其Robix视觉—语言单模型能搞定机器人推理、任务规划和自然语言交互,核心采用思维链推理和三阶段训练策略,效果超Qwen2.5 - VL、GPT - 4o等,负责人是李航。
硅谷惊变:12万张H100的挽歌
这是虚构故事,Meta用12万张英伟达H100训练“LLaMA 4 Maverick”,却被中国杭州DeepSeek团队用2000张GPU打败。项目失败成丑闻,扎克伯格成立实验室四处收购遇冷,新负责人管理混乱,实验室乌烟瘴气。
天下武功,唯快不破:LLM高效架构最新最全面综述
大型语言模型虽成就辉煌,但训练成本高、推理延迟大,核心问题源于Transformer架构。这篇综述论文首次系统性梳理高效LLM架构创新方案,分类七大类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。
Jina 第4版:多模态向量检索,统一适配,挑战3大任务
Jina第4版基于Qwen2.5 - VL模型扩展,支持单向量和多向量输出。它经对比学习和任务特化训练,推理时可按需选LoRA适配器,能利用多模态处理能力优化不同任务性能。
攻克大模型「表格盲区」!ST-Raptor框架发布,实现复杂半结构化表格的精准理解与信息抽取
半结构化表格布局多样、结构复杂,让自动化数据处理困难。上海交大等团队发布 ST - Raptor 框架,提出 HO - Tree 数据结构及树上操作,构建 SSTQA 数据集,提升表格问答准确率,弥补大模型处理短板。
模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26
华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。
人类画了100年的脑图,AI仅用几小时!还绘制出新脑区
加州大学旧金山分校团队提出CellTransformer算法,几小时完成5只小鼠脑图谱绘制,还绘出新脑区。该算法能准确对齐已知脑区,可扩展到多动物数据集,未来有望用于人类大脑及其他器官研究。