「训练系统」共找到 3646 篇相关文章
张小珺采访了Kimi杨植麟,Agent泛化的临界点来了。
张小珺采访Kimi杨植麟,杨分享技术见解。如Scaling Law遇瓶颈,应提升Token效率;Adam与Muon对比,Muon学习效率高;模型公司下场做一方Agent产品,垂直整合模式上限高;还谈及长上下文、Agent训练及管理方式等问题。
一年拿下三轮融资!影目INMO正在鼻梁上“复刻”一个AI手机
影目INMO在一年拿下三轮融资,近5亿资金到位。其产品INMO GO3等表现出色,首发预订量可观。该公司专注轻量化一体式AI+AR眼镜,结合自研系统与智谱大模型,还拓展线下渠道,全球化布局也在推进。
LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?
论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试集上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。
万亿级思考模型,蚂蚁首次开源!20万亿token搅局开源AI
10月14日蚂蚁集团发布万亿参数思考模型Ring-1T,在多领域表现出色,推理能力直逼闭源巨头。此前已开源旗舰通用大模型Ling-1T。还介绍了训练技术创新,虽模型有不足,但开源夺冠证明‘思考力’可工程化。
DeepDiver-V2来了,华为最新开源原生多智能体系统,“团战”深度研究效果惊人
华为发布DeepDiver-V2原生多智能体系统,采用“团队作战”模式,在复杂知识问答和长文报告生成上表现出色。它以Planner为中心协调多个Executor,有智能任务分解等优势,训练也有新机制,昇腾NPU集群加速。
中国最新Agent产品趋势:多体协同,垂直赛道,行业核心业务 | 量子位智库AI 100
量子位智库2025Q3 AI100榜单中的Agent产品亮点颇多。智能体技术从单点向系统协作发展,应用落地深化至行业。如科研、投资领域的Agent发挥重要作用,部分产品流量可观,多款新发布产品入围。
华为盘古大模型:被芯片牵制的“千古”模型
华为盘古大模型团队员工自曝内幕,称其受芯片限制,早期算力有限、训练困难。还指出内部存在造假、套壳等问题,如135B V2套壳Qwen 1.5 110B,pangu pro moe 72B套壳qwen 2.5的14b等,导致人才流失。
DeepSeek不惜代价保住它!V4关键特性被挖出来了
DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。
挺意外的,Agent长期记忆潜力被AMemGym挖出来了
论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。
警惕全球“最大”芯片IPO的暴雷风险
Cerebras 5月14日上市成2026年迄今全球最大IPO。其核心产品WSE工程有突破,但良率计算方式与传统不同。训练未成功,推理找到新机会。与OpenAI超200亿美元合同背后是股权换订单,财务数据也有隐忧,上市后存诸多疑问。