学习效率」共找到 2455 篇相关文章

开源动态8

装机量超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项

在大模型训练迭代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。

InfoQ
推荐文章7

大语言模型(LLM)到底是怎么运作的?(配图通俗讲解)

文章先介绍条件概率,指出大语言模型预测下一个单词是条件概率问题,会计算所有可能单词的条件概率选最高的。还提到直接选最高概率会使内容单调,引出温度概念,它能调整概率分布影响抽样结果。

宝玉AI
新闻资讯8

Ilya Sutskever多伦多大学最新演讲:即将上大学或正在上大学的强烈建议围观

2025年6月6日,ChatGPT之父Ilya Sutskever重返多伦多大学获荣誉理学博士学位并演讲。他分享人生建议,指出AI定义了“最不寻常时代”,建议学生体验使用AI,称其是人类最大挑战与机遇。

AI寒武纪
产品应用7

一年没用Perplexity,AI搜索进化惊呆我了丨TIP 005

Perplexity Lab推出后,AI搜索实现技术成熟度拐点。作者体验其新出的Perplexity Lab,发现它进化很大,如答案数据可视化、回答可交互等,虽有亏损且价格贵,但仍是实用的AI搜索。

鲸选AI
推荐文章8

逆向工程:ChatGPT 的记忆是如何工作的

文章是工程师eric对ChatGPT记忆系统的深度逆向工程和技术实现推测,详细拆解‘可保存记忆’和‘聊天历史’,分析工作原理、实现方案,探讨其对提升用户体验的作用,认为‘用户洞察’是关键。

AI寒武纪
产品应用8

每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程

华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现大模型高效训练。

量子位
算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
新闻资讯8

NVIDIA团队让编程Agent接管真实机器人实验,成功率达99%

NVIDIA GEAR 实验室负责人介绍 ENPIRE 项目,首次在机器人硬件实现自动化研究。让 8 个 Codex Agent 驱动闭环,完成高精度任务,成功率 99%。项目计划开源,还提出 MRU 与 MTU 指标。

机器之心
产品应用7

既要安全⼜要弹性,理想汽车如何解开企业 OpenClaw 落地死结|甲子光年

2025年以来,大模型应用飞速发展,以OpenClaw为代表的开源框架是变革催化剂,但其在企业级生产环境有缺陷。理想汽车以阿里云ACS Agent Sandbox及ACK为核心,为Agent构建专属‘沙箱’,解决落地难题。

甲子光年
产品应用7

Lyft 使用 AI 和人机协同扩展了全球范围内的本地化能力

Lyft 实现 AI 驱动的本地化系统,加速应用与网页内容翻译。新系统结合大语言模型、自动评估与人工审核,将翻译周期从数天缩至分钟级,兼顾质量与适配性,还分批量和实时翻译架构处理不同场景。

InfoQ