「模型训练难题」共找到 8796 篇相关文章

新闻资讯8

三大头部互联网企业交锋,AI时代可观测边界出现了吗?

InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代可观测新边界。嘉宾们认为AI与可观测技术双向赋能,传统算法与大模型互补,未来有望实现半自治运维,还分享了数据治理等经验。

InfoQ
产品应用8

国内首次!8.9毫秒推理速度破纪录,1元打穿百万token

在2025人工智能计算大会上,浪潮信息发布元脑SD200和元脑HC1000两款AI服务器。前者让DeepSeek R1的Token生成速度达8.9毫秒,后者将推理成本降至1元/百万Token,解决了AI智能体速度与成本难题。

新智元
产品应用8

一家低调的工业AI公司,用TPT跨越生成式AI鸿沟|甲子光年

麻省理工学院报告指出约95%生成式AI企业试点无实质回报,存在生成式AI鸿沟。工业AI落地难,中控技术的TPT及TPT 2模型,在兰州石化榆林化工应用效果好,其优势源于数据和行业经验,也体现了破局决心。

甲子光年
新闻资讯7

英伟达和AMD,开始争夺AI制药的计算入口

每年的 Advancing AI 大会,AMD 都要回答 Instinct GPU 除训练大模型外的应用问题。今年大会上,AMD 把一个位置留给 AI 制药公司 MindWalk。而其对手英伟达已在生命科学领域布局多年,生命科学成两家竞争新战场。

DeepTech深科技
新闻资讯7

Claude 小升级就赢了OpenAI 9年“开源神作”?高强度推理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?

OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌Deepmind推Genie 3,Anthropic放出Claude Opus 4.1。Claude Opus 4.1编程性能提升,实测编码能力强于gpt - oss。gpt - oss虽有亮点,但幻觉率高、实测效果不佳。

AI前线
新闻资讯7

全球看中国,灵初智能用10万小时人类数据写下具身智能的中国答案

2026年,“世界模型”成具身智能高频词。灵初智能联合创始人陈源培认为其非核心方向,而是数据迁移工具。灵初关注人类操作数据转化,在10万小时量级上可大幅替代真机数据,还介绍了系统模块、数据集及商业化阶段等情况。

机器之心
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升大语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
新闻资讯8

在「外滩大会·具身智能:从泛化到行动,重塑产业未来」上,这些大牛都说了什么?

9月11日,机器之心联合出品的外滩大会见解论坛聚焦具身智能。多位学界和业界代表分享看法,如孙富春称训练场可破数据瓶颈,江磊指其是新型数据工厂。思辨和圆桌环节探讨技术路线、应用场景等关键问题。

机器之心
推荐文章7

AI 已能写 80% 代码,但 Agent 也有致命短板!OpenAI Codex 技术总监:问错了,比不会写更麻烦

OpenAI Codex 技术负责人 Michael Bolin 在访谈中回顾职业轨迹,分享从工程师到工具创造者的成长经历。他认为 AI 编程时代 80%-90% 代码可由模型生成,但关键部分需人类把控,提出正确问题能力更重要,编程智能体执行将更多迁移到云端。

InfoQ
开源动态8

「具身原生」元年!专访原力灵机汪天才,解析具身智能的「PyTorch时刻」

2月10日原力灵机发布开源具身原生框架Dexbotic 2.0,宣布与RLinf合作。合伙人汪天才将其与RLinf结合定义为具身智能的「PyTorch时刻」。还推出具身大模型DM0和应用量产工作流DFOL,推动具身智能进入「具身原生」时代。

机器之心