「无数据训练」共找到 4379 篇相关文章
特斯拉Cybercab正式上线:没有方向盘没有刹车,已开始在奥斯汀拉客
当地时间9月3日,特斯拉在奥斯汀启动Cybercab付费服务,该车无方向盘、刹车等。其成本约1.8万美元,远低于对手。不过,它面临监管和技术约束,目前投放规模小,未来发展待验证。
蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
Agent = Model + Harness,一个可能成为2026年出圈的新概念
文章提出新概念Harnesses Engineering,认为Agent = Model + Harness,阐述了Harness的作用、核心组件,还提及模型训练与Harness设计的耦合及Harness工程未来,指出需‘Harness思维’让AI驱动工业革命。
一种用于管理 AI 变革步伐的演进式架构模式
Cloudflare推出基于QuePaxa共识算法的Meerkat服务,可无领导者写入并保持强一致性,提高网络可用性。它预计将是QuePaxa全球首次生产部署,但存在局限性,如大量往返通信。
开源一周狂揽 35K 标星!Karpathy 开源 autoresearch:630 行代码让 AI 自动“炼丹”!
前OpenAI、特斯拉前AI总监Andrej Karpathy发布新项目autoresearch,一周揽35.6k Star。它是极简版LLM训练环境,630行代码让AI自动做研究,人类通过Prompt指导,AI自行实验。
拖拽视频编辑进入流式时代!任意时刻、任意内容,实时修改 | ICLR'26
新加坡南洋理工大学和合肥工业大学研究人员在ICLR 2026提出REVEL任务,打造免训练DragStream方法,实现视频生成时实时拖拽编辑,支持多种操作,破解两大难题,实验显示效果、泛化性佳。
Linus 之后的 Linux?内核社区终于写下“接班预案”
Linux内核社区准备了一套交接方案,以防Linus Torvalds发生意外或退休。该计划未指定唯一继承人,明确了选择流程。有人提议拆分顶层维护职责给多人,目前Torvalds暂无退休打算。
架构解耦是统一多模态模型所必须的吗?全新AIA损失:No
香港中文大学 MMLab 和美团研究者思考架构解耦是否为统一多模态模型必须,推出 AIA 损失。研究发现架构解耦未解决任务冲突,AIA 能提升模型性能,减少数据配比问题。
腾讯音乐如何基于 AutoMQ 降低 Kafka 50%+ 成本
腾讯音乐旗下产品产生海量数据,传统自建 Kafka 集群运维复杂、成本高。为此,运维团队选 AutoMQ,将成本降超 50%,提升扩缩容效率,降低运维负担,本文分享其经验。
Perplexity不仅没死,而且很强
文章对比通用AI搜索与Perplexity,指出通用AI搜索用于金融投资不够严谨准确,而Perplexity从专业金融API拉取数据,集成权威数据源,准确度高。在此基础上推出的Perplexity Computer功能强大,是严肃工具。