「AI预训练范式」共找到 11315 篇相关文章
GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率
OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。
二十年老牌 IDE 栽在 AI 上?JetBrains 被差评逼疯批量删除评论,用户怒打 1 星抗议
JetBrains的AI助手插件下载超2200万次,但评分仅2.3分。用户不满其自动安装、速度慢、bug多等问题,负面评论被批量删除引发抗议。公司虽推出免费套餐和新AI智能体Junie,但仍面临成本、竞争等难题。
创始人跑路一年后,员工接盘把这家AI公司干到年入破亿!如今想含泪甩卖:真的“难以承受”
曾红极一时的AI聊天机器人公司Character.AI,在创始人跑路一年后,员工接管并聘请新CEO,业务有进展,预计年底年化收入达5000万美元,但运营成本高,还面临融资、竞争、监管等问题,正权衡出售或融资。
商汤王晓刚:世界模型将加快AI从数字空间进入物理世界,「悟能」想做那个桥梁
具身智能“大脑”成AI竞争焦点,“世界模型”或是通往“类人智能”的解法。商汤科技王晓刚认为世界模型将加快AI从数字空间进入物理世界,其推出的“悟能”具身智能平台想做这个桥梁,还谈到具身智能发展面临的问题与挑战。
R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式
复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三大瓶颈,训练后模型性能双重提升。
4B小模型数学推理首超Claude 4,700步RL训练逼近235B性能 | 港大&字节Seed&复旦
香港大学NLP团队联合字节跳动Seed、复旦大学发布Polaris强化学习训练配方,让4B模型数学推理能力超商业大模型,且Polaris-4B可在消费级显卡部署,相关内容已全部开源。
一个大脑控制所有机器人,真的可能吗?特斯拉、Skild AI、Agility 激辩人形机器人的量产路线|GTC 2026
GTC 2026 上,特斯拉、Skild AI 等公司就人形机器人量产路线展开讨论。涉及数据采集、仿真作用、模型架构等话题,各公司观点不一,如特斯拉强调端到端,Skild AI 看重通用大脑,反映出行业在迈向量产时的探索与分歧。
我去,真有这种,Openclaw 增强工具,ClawRouter 让 AI Agent 自己选模型、自己付钱,还能把 LLM 成本打下来 90%,爽~~
ClawRouter是开源本地LLM Router / Proxy,支持55+模型,能让AI Agent自动选模型、付费,将LLM成本降90%。它解决路由、支付等问题,适合做AI Agent、编程工具等产品的开发者。
Agentic RL训练:它不是单一 RL 算 法,而是一整套环境建模、学习信号、异步数据流、策略优化和基础设施的协同系统
文章指出Agentic RL训练不是单一算法,而是协同系统。它与传统RL不同,有四个训练变化。理解它要围绕三个不变量,还从环境建模等八个方面阐述,强调其竞争在于环境、信号、分布与系统的协同闭环。
壁仞中昊芯英行云集成电路都来了!中国AI算力大会6月举办,聚焦推理算力、AIDC、异构混训与超节点
2025中国AI算力大会6月26日在北京举行,是“智领未来”活动之一。大会设主、分会场与展览区,解构AI算力变局。公布主、分会场嘉宾阵容,含中昊芯英、中科加禾等创始人,报名火热进行中。