「端到端学习」共找到 3509 篇相关文章
Auto Research时代,AI Scientist的第一场药企实习考验|甲子光年
AI Scientist从大模型做题家进化为自动化科研助手,但从demo到应用面临买单难题。Phylo等团队构建BiomniBench评估框架,让AI做药企真实数据分析,结果显示AI表现超人类实习生,且有速度和成本优势,但也存在偏科问题。
全国首部“高质量数据集验收”标准,现公开征集起草单位和专家!
国家数据局等明确支持数据流通服务机构与人工智能企业合作,凸显数据到模型训练与产业应用环节的重要性。现有数据质量标准在产业场景有缺口,全国首部《人工智能训练数据集交付与质量验收规范》团体标准应运而生,现征集起草单位和专家。
SentGraph:一句一句把多跳RAG“画”成图
传统RAG在多跳场景易‘断链’,因检索单元太胖、逻辑关系乱。SentGraph把检索单元缩到句,按逻辑画三层图。线下建图分拆句、找关系、架桥梁;线上推理有Anchor初选、精炼及路径扩展。实验提升显著,也有局限。
英伟达4B小模型击败GPT-5 Pro!成本仅1/36
英伟达ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。
读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源
Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。
EMNLP 2025 | T2R-bench: 业内「首个」工业级表格生成报告评测基准
中国电信人工智能研究院推出业内首个面向真实工业场景的“表格到报告”基准T2R-bench,涵盖多领域真实表格、问题与人工标注关键点,配套创新性三维度评测体系。实验显示主流大模型在该任务上表现欠佳,提升空间大。
英伟达&MIT等推出Long-RL,长视频训练速度翻倍
英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。
五源刘凯:喧嚣只是表象,AI创业才刚刚开始|5Y View
五源合伙人刘凯在圆桌会上谈AI创业现状。他认为AI正从集中走向开放,创业者主动权增大。还提及投资AI项目的判断标准,指出ARR在C端产品失去参考价值,不同类型项目评估方式有别,且认为当下AI创业才起步。
RAG技巧与底层代码剖析
文章深入剖析 RAG 技巧与底层代码,从用 Python 基础库构建 RAG 系统,到多种优化方法如上下文增强检索、添加上下文块标题等,还涉及查询改写、重排序等技术,最后介绍了上下文压缩、反馈机制等提升系统效率和质量的方法。
超越 GoF:现代 AI 系统实用设计模式
文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。