「多任务训练」共找到 6600 篇相关文章
腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式
过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。
斩获近5w star!这个开源AI工具让你30 秒搞定“过去30天真相”!
信息碎片化时代,last30days开源AI工具聚合各平台“人群智慧”,按真实人群参与度打分合成摘要。它能搜索多平台,v3版有智能搜索等新功能,输出HTML摘要,优点多且易上手。
我们开源了一个可以降低 AIGC 率的模型
毕业季学校查 AI 率,作者为降 AIGC 率,经尝试不同路径后训练出模型。介绍训练数据和过程,包括 SFT、DPO 各阶段,展示改写效果,还开源模型和数据,最后引发对教育检测的思考。
刚刚,国产AI自己造了AI,全球首例!
面壁智能实现全球首例国产AI造AI,用AI编写预训练框架ForgeTrain,性能超英伟达Megatron,还训练出MiniCPM5 - 1B模型。该模型可作桌宠,小尺寸高智能,还能自定义人格,提供工具链。
最新12种GraphRAG技术全面评测
6月两篇论文对12种GraphRAG技术评测。GraphRAG通过构建图结构组织知识,在复杂推理等任务中优于传统RAG。不同GraphRAG技术在图构建、知识检索上表现各异,如RAPTOR图构建慢但令牌消耗少。
o3 Gemini 都翻车?首个可验证长链 GUI 数据集 VeriGUI 重磅开源,探索通用 Agent 能力边界
GUI 智能体发展遇瓶颈,现有数据集难评估其长时程规划能力。2077AI 开源基金会牵头构建的 VeriGUI 应运而生,有长链复杂性与子任务级可验证性特征,论文登 Hugging Face 月榜第三,还证明现有模型瓶颈。
最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成本降 45%,Anthropic 把顶级模型送进真实世界
当地时间9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,新模型在多方面能力提升,Agent工作负载成本最高降45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。
预测下一个像素还需要几年?谷歌:五年够了
谷歌DeepMind研究者分析下一像素预测在图像识别与生成任务中的扩展特性。实验显示其扩展趋势与文本类似但效率低,最优策略因任务和分辨率而异,预计未来五年逐像素建模可行。
一篇被证明“理论有误”的论文,拿下了ICML2025时间检验奖
2015年发表的Batch Normalization论文在ICML 2025会议获时间检验奖。它引用超6万次,推动了深层神经网络发展。虽2018年被指理论有误,但仍有新研究发现其对训练过程的根本影响。
中国具身模型狂揽全球第一!机器人的人类数据时代来了
00后带队的灵初智能用近10万小时人类数据拆解具身智能,1000小时数据开源。其发布Psi-R2和Psi-W0双系统架构,让Psi-R2登顶MolmoSpace榜单。灵初认为纯人类数据训练必要,还强调开源对具身智能落地重要。