机器学习专家」共找到 2008 篇相关文章

新闻资讯7

“像把大象塞进冰箱一样困难”,端侧大模型是噱头还是未来?

InfoQ《极客有约》X AICon 直播聚焦端侧大模型,探讨其落地挑战与破局思路。专家指出端侧部署有隐私、可用性等优势,但面临内存、精度等难题。华为、支付宝等分享方案,还探讨应用场景、商业模式及未来趋势。

InfoQ
算法论文7

在Think中边搜索边调整的搜索增强Reasoning方法

LLM虽知识丰富,但无法掌握训练数据外的信息,传统检索增强生成方法有缺陷。AutoRefine提出“先筛选,再回答”理念,用强化学习训练,实验显示在多方面碾压传统方法,未来或改变知识密集型任务解决方式。

深度学习自然语言处理
开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
7

监管正式落地严查,全国首部AI产品合规标准来了

自2023年相关办法发布,国家监管网越织越密,AI产品合规成企业必答题。《生成式人工智能产品安全与合规指南》团体标准应运而生,构建全生命周期合规体系,有全链路、全场景、全配套亮点,还公开征集起草单位与专家

AI工程化
新闻资讯7

GPT-5惨遭零分打脸,顶级AI全军覆没!奥特曼AI博士级能力神话破灭

FormulaOne硬核测试让顶级大模型现原形,其题目分三关,基础题AI还行,进阶题和最深层题表现惨不忍睹。该测试由AAI公司出品,问题具商业价值,反映出当前AI离真正专家还有距离。

新智元
开源动态8

媲美Claude 4,支持100万上下文!阿里开源超强代码AI Agent模型

阿里巴巴开源超强AI Agent模型Qwen3 - Coder - 480B - A35B - Instruct,测试分数媲美Claude Sonnet 4,超越DeepSeek。它参数多、支持大上下文窗口,训练数据优质,还进行代码强化学习扩展训练等,有对应命令行工具。

AIGC开放社区
新闻资讯7

DeepSeek 新模型曝光,即将发布

据彭博社消息,年初凭 R1 模型震动全球的 DeepSeek 正开发全新 AI Agent 模型,创始人推动团队在今年四季度发布。该模型能代表用户执行多步骤操作、基于过往行为学习改进,行业也在向 Agent 软件转型。

AGI Hunt
新闻资讯7

95后,边改造业务边发AI顶会论文,是怎样的体验?

当下AI人才竞争激烈,企业各出奇招。今年5月京东技术沙龙零售专场,技术团队分享成果。几位95后青年专家讲述成长历程,如洛川解决CTR模型训练瓶颈,谦屹发表多篇顶会论文。京东还推出人才计划吸引人才。

机器之心
算法论文8

合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型

为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。

新智元
新闻资讯7

谷歌Gemini | 一次提示能耗≈看9秒电视剧?

谷歌发布Gemini能源消耗研究报告,称处理中位数文本提示能耗低,2024 - 2025年能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑方法论,指出未算间接用水、碳排放核算不全等问题。

AINLPer