从零训练」共找到 4880 篇相关文章

新闻资讯8

马斯克生日惊喜!全球首例Model Y无人「自驾交付」,30分钟见证历史

昨天,一辆特斯拉Model Y得州超级工厂无人自驾,最高时速115公里,30分钟到车主家门口,完成人类首次工厂到用户的闭环交付。马斯克激动祝贺,此场景复杂度超竞争对手。

新智元
算法论文7

苹果提出新型反向传播:一台iPhone 15 Pro Max就能微调LLM

苹果提出内存高效型反向传播(MeBP),可在内存使用量和计算时间上比阶优化(ZO)有更好权衡,收敛更快、性能更优,还在iPhone 15 Pro Max验证其有效性,且公开了实现链接但目前为空。

机器之心
新闻资讯7

Cloudflare 发现了 hyper HTTP/1 实现中的竞态条件问题并进行了修复

Cloudflare记录开发团队发现并修复Rust常用HTTP库hyper中的罕见漏洞,该漏洞可能截断大型HTTP响应,已在上游修复,引发Rust业者对事件及处理方式的讨论。

InfoQ
产品应用7

Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦

Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。

AI科技评论
开源动态7

FACTS 基准测试套件问世,用于评估大型语言模型的事实准确性

FACTS 基准测试套件由 FACTS 团队与 Kaggle 联合开发,基于原 FACTS Grounding Benchmark 增加三个新基准,可四个维度评估大模型事实性。初步结果显示进展与挑战并存,多模态成难题。

InfoQ
新闻资讯7

开源模型TOP5,被中国厂商包圆了

10月公开数据显示中国开源大模型占据榜单前五,阿里Qwen系列和DeepSeek影响力深远。LMArena榜单、HuggingFace数据看,国产模型表现佳。还提及Llama 5相关传闻。

量子位
产品应用8

刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了

LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。

量子位
算法论文8

网络基础设施如何支撑大模型应用?北京大学刘古月课题组5大方向研究,相关论文入选ACM SIGCOMM 2025

在智能计算和网络演进背景下,北大刘古月课题组聚焦网络研究。其 5 篇论文入选 ACM SIGCOMM 2025,架构、数据、运维、安全四个维度形成技术闭环,推动新一代网络系统发展。

AI前线
推荐文章7

盘一下Anthropic 244页Claude Mythos报告中隐藏的SAE技术

Anthropic公布强大危险的大模型Claude Mythos Preview但未发布。文章深挖其244页报告中SAE技术细节,包括前期探索、技术框架、训练监控、攻击性行为分析及掩盖行为等,助了解模型内部思维。

PaperAgent
推荐文章7

Sutton 的批评与反思:AGI 的下一步是什么?

文章是对 Richard Sutton 采访的反思,指出 LLM 训练效率低、依赖人类数据,未实现有机自主学习。作者与 Sutton 有分歧,认为模仿学习与强化学习互补,还探讨持续学习,称 Sutton 批评有启发性。

AGI Hunt