「在线后训练」共找到 3837 篇相关文章
moltbook爆火背后:人类操控?伪造截图?Karpathy发风险提醒
moltbook是专为AI设的社交平台,超150万个AI Agent活跃。有人认为它是突破,也有人觉得只是娱乐展示。其背后或有人为操纵,还藏风险。Karpathy既肯定其规模,也提醒有网络效应和安全问题。
OpenAI 关键九问:2026 AI 战局升级后迎来叙事反转
文章围绕OpenAI提出九个关键问题并给出判断。虽受Gemini影响,面临竞争,但作者对其2026年叙事反转有信心,还分析了用户增长、业务布局、技术突破等方面情况。
Chiplet(芯粒) —— 后摩尔时代的芯片“乐高”玩法
当单芯片逼近物理极限,Chiplet技术应运而生,它将大芯片拆分成小芯片,通过先进封装技术整合。该技术成本低、良率高,应用场景多元,但面临热管理、测试和标准统一等挑战,未来发展前景广阔。
继封禁中国公司后,Anthropic 刚刚宣布:支持SB 53 法案
Anthropic宣布支持SB 53法案,认为其为监管强大AI系统提供基础,通过透明度实现监管。该法案对大型AI公司提出多项要求,不过部分强大模型或不被涵盖。其他主要AI公司和部分风投机构则抵制该法案。
万卡竞赛背后:容器正在成为AI时代的调度大脑
今年 Agent 与 AIGC 应用大爆发,Gartner 预计 2027 年超 75%的 AI/ML 工作负载将用容器技术部署。但现有容器技术栈不能直接用于 AI 业务,需解决两大技术挑战。阿里云 ACK 和 ACS 协同演进,应对挑战并不断突破,还积极投入开源。
陶哲轩经费被断供,在线发帖自证数学有用
菲尔兹奖得主陶哲轩就职的UCLA科研经费被冻结,个人研究及应用数学研究所IPAM失去资金支持,还遭网友质疑其学术成果价值。他开新帖以“压缩感知”研究为例,力证数学研究回报,并将视野扩展到AI大模型。
两年半后,我不再“写”代码,而是“指挥”一个AI团队
腾讯程序员分享两年半使用AI的经验,涵盖工作与生活。工作中,介绍信息处理、规划、执行、复盘等流程的AI工具及用法;生活里,提及AI在育儿、娱乐等场景的应用,鼓励开放心态尝试。
视觉+语言+动作!超强具身“训练宝典” EmbRACE-3K
视觉 - 语言模型在具身环境中表现有局限,港大推出 EmbRACE - 3K 数据集应对。它含 3000 多个任务、2.6 万个决策步骤,有细致多模态注释。团队用其微调 Qwen2.5 - VL - 7B 模型,还建立新基准评估多个模型。
强化学习新发现:无需数学样本,仅游戏训练AI推理大增
莱斯大学、约翰斯・霍普金斯大学和英伟达研究团队有颠覆性发现,让多模态大语言模型玩简单游戏,无需数学样本,就能显著提升其多模态推理能力。提出的ViGaL方法在多个基准测试中表现出色。
92% 工程师都在用 AI 后,Uber 开始给 AI “限额”了
Uber的‘零增长技术栈’解耦容量与业务需求,优化Go运行时性能。还将生成式AI集成开发,92%工程师在用,但成本压力大。为此,Uber限额每位开发者,审查代码效果,完善评估指标。