「训练流程」共找到 2811 篇相关文章
万卡时代,企业需要怎样的算力集群?
过去两年,AI算力需求跃升,消耗从训练主导转向推理驱动。企业算力需求有突发性等特点,智算集群是关键方案。InfoQ联合腾讯云发起直播探讨,还介绍了算力供给缺口、集群构建交付、性能优化及演进方向。
分钟级定位 IO 瓶颈:多租户云环境下的智能诊断
随着云上规模扩张,多租户云环境下 IO 请求量剧增,IO 问题排查难。阿里云操作系统控制台构建 IO 一键诊断能力,能快速识别问题类型、把握诊断时机、屏蔽复杂关联流程,还介绍了实现原理和案例。
14万一台家务机器人!斯坦福华人博士具身创业首款产品亮相,用户还能买回去自己教
斯坦福华人博士赵子豪与迟宬创业推出家务机器人Memo,售价2万美元。它能完成多项家务,依赖ACT - 1具身模型,该模型用技能捕捉手套采集人类数据训练,用户还能教它新本领,预计2026年正式推出。
奥特曼想要一个「AI接班人」!劈柴:这一天会来的
近日,奥特曼自曝「AI接班人」计划,认为AI近年能胜任OpenAI部门管理,最终覆盖企业流程。OpenAI企业客户破百万,其构想或为盈利拼图。但目前AI难取代CEO,奥特曼若被取代就去当农民。
长生不老成真?哈佛AI数周破解「衰老密码」,人类寿命或迎重写
哈佛团队借助AI系统K-Dense揭示衰老分阶段运行的秘密。K-Dense采用层级多代理架构,能完整跑通研究流程,在BixBench测试中超越GPT - 5。它还让哈佛团队几周完成原本数年的研究,成果待同行评审。
上海AI Lab提出CANON:让RLVR自主识别优质推理模式
上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。
Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」
Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。
你可能没注意,腾讯已经把 AI 融进了这两个关键场景
作者参加腾讯全球数字生态大会AI协同办公与组织升级专场,关注腾讯乐享AI知识库和腾讯电子签合同智能引擎。乐享解决传统知识库痛点,让知识融入工作流;电子签实现合同管理全流程智能化,解放法务劳动力。
从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」
新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。
李飞飞一年前究竟说了啥?怎么又火了
AI教母李飞飞一年前访谈再引关注,她指出大语言模型或许并非真正智能,其基于一维语言信号训练,在理解三维物理世界存在局限。相关实验也证实大模型在物理任务表现差,不过也有人提出不同观点。