「训练导向问题」共找到 4887 篇相关文章
来自 OpenAI 离职员工的爆料:关于 OpenAI 的一些思考
OpenAI 前员工分享工作感悟,谈及公司文化、代码管理、个人收获及 Codex 发布情况。指出公司成长快但扩张中问题多,文化自下而上且精英主义,代码库大且围绕聊天构建,Codex 发布迅速成果佳。
刚刚,OpenAI发长文:找到缓解LLM撒谎的方法!
Google发布Gemini 3 Deep Think,ARC - AGI - 2准确率高且采用并行推理技术。OpenAI发长文《通过忏悔训练大型语言模型诚实性》,介绍缓解LLM撒谎的忏悔训练法、实验结果等,也指出其局限。
Claude/Codex又爆猛烧钱bug,随时准备烧空你的额度,官方躺平不修复。
Claude、Codex这两个用户量大的Agent产品,存在官方不修复的烧钱bug。往会话贴的图片以base64存于session历史,反复重发计费,严重时会话废掉,官方此前也对类似问题不作为。
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
机器人长出800个心眼?阿里达摩院开源具身新大脑,硅谷又坐不住了
2026年具身智能竞争激烈,阿里达摩院开源RynnBrain“具身大脑”。它采用分层架构,在16项评测中超越前沿模型。还介绍了核心技术、训练策略等,且全系列模型、评测基准和代码均开源。
集合通信库VCCL释放GPU极致算力,创智、基流、智谱、联通、北航、清华、东南重磅开源
在超大规模智算集群需求下,创智、基流等多方联合开源集合通信库VCCL。它基于NCCL开发,有智能调度、容错、细粒度观测机制,实测能提升算力利用率、降低故障率,还解决了服务器异构等问题。
阿里智能体多轮推理超越GPT-4o,开源模型也能做Deep Research
通义实验室推出自主信息检索智能体WebDancer,其通过系统化训练范式为构建智能体提供路径,也为在开源模型上复现Deep Research系统提供指导。它在多数据集测试中表现出色,团队还对其未来应用做了展望。
蚂蚁集团发布KAG-Thinker,多跳问答慢思考,医疗领域拿下87分
在LLM问答领域,多跳问题存在局限性。蚂蚁集团发布KAG - Thinker,它是基于KAG框架的模型,能解决复杂问题的逻辑连贯性和上下文一致性。还介绍了其工作原理、示例、医疗应用及稳定性表现。
刚刚,OpenAI在ICPC 2025编程赛上满分登顶,Gemini也达到金牌水平
在ICPC 2025编程赛上,OpenAI 5小时内解决12个问题满分登顶,其由通用推理模型集成体构成,结合GPT - 5与实验性模型;Gemini解决10个问题达金牌水平,在部分难题表现出色。
谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发数学新构造
著名数学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新数学构造,该系统结合 LLM 与进化计算,在多领域问题上表现出色,还能与其他 AI 工具结合。