「训练数据合成」共找到 4020 篇相关文章
Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%
为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。
支付宝出手了,全民级的AI健康管家来了。
作者参加蚂蚁AI医疗产品发布会,介绍了全新AI产品AQ。它是专门的AI健康助手,免费用,能精准定位病因,还可预约挂号,与医保打通,有健康档案等功能,打破医疗信息差,未来可期。
FutureHouse 联合创始人:AI Scientist 不是“全自动化科研”
FutureHouse 由 Google 前 CEO 资助创立,今年 5 月推出四个 AI 科研 agent,6 月宣布 AI 系统 Robin 发现新药。联合创始人 Andrew White 表示,AI Scientist 并非‘全自动化科研’,生物比化学更具‘平台化’潜力,团队聚焦科研自动化。
AI Infra 工程师们如何应对大模型流水线里的“暗涌”?
InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代冲突处理、推理部署成本优化、开源项目挑战及 GPU 虚拟化趋势等内容。
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。
为AI打造的知识图谱服务器MemoryMesh
MemoryMesh是专为AI模型设计的知识图谱服务器,适用于多种结构化数据场景。它有动态模式驱动工具等特性,可自动生成管理工具,还配备记忆查看器,提供安装指南和提示词建议。
Claude与人类共著论文,苹果再遭打脸!实验黑幕曝光
苹果一篇质疑大模型推理能力的论文引发争议。Open Philanthropy研究人员联手Anthropic发表论文,揭露苹果论文三大缺陷,指出部分测试无解却让模型“背锅”,还给出正确评价大模型推理能力的方法。
灵初智能陈源培:一个 00 后的机器人之梦
00 后陈源培是灵初智能联创,本科土木工程专业,大二因比赛对机器人感兴趣。他研究灵巧手,参与开源项目,灵初发布相关模型。他认为强化学习对灵巧手重要,还谈了模型、创业、落地等看法。
微软开源AI量化神器Qlib
微软开源AI量化平台Qlib,支持多样机器学习范式,解决量化投资挑战。包含数据处理等完整流程,有安装、数据准备等说明,还提供自动化和定制化工作流,以及应对挑战的方案和性能对比。
谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍
大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。