大前端」共找到 5153 篇相关文章

开源动态8

专为“超模型而生”,新一代训练引擎 XTuner V1 开源!

9月8日,上海AI实验室开源书生模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。

OpenMMLab
推荐文章7

深刻理解Token:语言模型(LLM)是如何看待这世界?

文章指出在语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越攻击越易,还对微调数据集实验,引发讨论。

InfoQ
8

AI教父Geoffrey Hinton,全球第二个百万引用科学家!

AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑模型运行。他还称模型是黑箱,领域待探索。

新智元
算法论文8

告别「利用率崩溃」:GIPO开启模型强化学习高效训练新方法 | ICML 2026

树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。

AI科技大本营
产品应用8

GPT-5.2技术炸场!6核心突破,办公效率拉满

OpenAI凌晨发布GPT-5.2,把专业级AI门槛拉到新高度。它有6核心技术突破,精准戳中职场痛点。在GDPval基准测试中表现出色,有三级模型矩阵,不同版本满足不同需求,各方面能力均有显著提升。

CourseAI
开源动态8

1.3万人收藏的 OpenHarness!港开源轻量级 Agent 基础设施,兼容性拉满!

近期,香港学数据科学学院团队开源项目 OpenHarness,它是 Agent 基础设施,有 Agent Loop、工具箱等亮点,功能特性丰富,支持多种模型提供商,还提供多种安装和配置方式。

开源星探
新闻资讯8

模型到智能体:50+ 头部企业的 AI 进化实践

2025年AICon全球人工智能开发与应用会6月27 - 28日在北京举办,50余家机构专家围绕AI Agent等前沿技术探讨落地实践与趋势。极客邦等企业代表分享应用布局,还有5主题演讲、14个技术专场和50多个标杆案例。

InfoQ
推荐文章8

NVIDIA技术沙龙 《规模EP优化:PD分离MoE并行方式》课程笔记

本文是NVIDIA技术沙龙课程笔记,介绍规模EP优化的PD分离MoE并行方式。涵盖PD分离、规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。

GiantPandaLLM
新闻资讯8

OpenAI公开62页核心手稿!AI连破十「菲尔兹奖级」难题

OpenAI公开62页核心手稿,展示GPT对十「菲尔兹奖级」数学难题的完整推演,涵盖高维球体堆积、非sofic群构造等。仅花2000美元Token成本,引发全网热议,被指或为GPT - 6,强化学习佬称像“奇点前夜”。

新智元