端到端训练」共找到 4176 篇相关文章

推荐文章7

119 页硬核报告丨AI 2030:算力、能源与科研的未来预测

Epoch AI 受 Google DeepMind 委托编写报告,探讨 AI 规模扩张至 2030 年在计算、投资等方面的影响,认为扩张很可能持续,还会加速多领域科学研发,虽预测有不确定性,但 AI 会成关键技术。

特工宇宙
算法论文8

GPT-5都救不了的AI幻觉,原来问题不在模型,在“考卷”

OpenAI研究指出AI产生幻觉的根本原因是评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。

AIGC开放社区
产品应用7

OpenAI Codex彻底火了,4个官方前提示示例给你

OpenAI Codex热度飙升,很多用户从Claude code转投其怀抱。它在响应式和移动开发表现出色,文中给出像素游戏、工作管理平台等4个官方前提示示例及中英文表述。

AI寒武纪
推荐文章8

CUDA-MODE第77课课程笔记:用于GPU kernels的DSL

该课程笔记由Tri Dao介绍GPU kernel开发的DSL生态,涵盖PyTorch、Triton、Cute - DSL等。提出计算效率评估公式,对比不同DSL在Softmax、GEMM等操作的性能。还提及其他DSL工具与Triton扩展项目,并给出使用建议。

GiantPandaLLM
新闻资讯8

Transformer作者:DeepSeek才有搞头,OpenAI指望不上了

Transformer发明者Ashish Vaswani认为OpenAI等闭源厂商被商业化冲昏头脑,没心思做基础研究。他All in基础研究,坚持开源路线,想打造西方世界的DeepSeek。其团队论文提出颠覆性观点,或降低训练成本。

量子位
新闻资讯7

OpenAI五年内狂烧1150亿美元应战!年营收将达2000亿美元

OpenAI向股东通报,2030年累计烧钱或达1150亿美元,用于自建数据中心。同时预测2030年营收达2000亿美元,ChatGPT贡献显著。虽成本高,但资本按5000亿美元估值加仓。

新智元
开源动态8

开放全栈!超越π0,具身智能基础大模型迎来真·开源,开发者狂喜

继π0后,具身智能基座模型WALL - OSS正式开源,多项指标超越π0。它是通用多模态具身模型,具良好推理和泛化能力。背后自变量机器人刚完成近10亿A + 轮融资,开源将降低具身智能门槛。

量子位
推荐文章7

Vibe Coding两年盘点:Windsurf已死、Cursor估值百亿,AI Coding的下一步怎么走?

文章回顾2023年初2025年中AI Coding发展,涉及Cursor、Codeium等产品轨迹。指出极‘坏用户’使商业模式崩塌,需平衡‘交付质量’与‘token成本’,还提及‘Knowledge Suggestion’功能及目标用户选择。

Founder Park
算法论文8

港科广×腾讯联手打造《我的世界》神操作,400张截图就能让AI挖矿通关,成本降至5%|EMNLP 2025

港科广与腾讯联合团队提出VistaWise框架,将“跨模态知识图谱+轻量化视觉微调”引入开放世界智能体。实验显示其在“获取钻石”任务表现出色,成果被EMNLP 2025主会录用。该框架以低成本、跨模态为突破口。

量子位
新闻资讯7

Skywork技术论坛一手分享:Agent与多模态的落地真相|甲子光年

8月19日,昆仑万维发起第一期Skywork全球技术论坛讨论会,众多高校和企业嘉宾围绕Agent与多模态展开交流。探讨了Agent商业化、多模态应用等核心问题,提出诸多判断,指出行业热度高但落地是关键。

甲子光年