国科大」共找到 5050 篇相关文章

推荐文章7

AI越强,企业越迷茫:顶尖CIO们的十真实之问

阿里云CIO与40余家头部企业CXO深度碰撞,总结出《企业智变下的CIO集体之问》。报告指出企业AI落地困境,如数字人认知混沌、知识库建设难等,探讨十经典问题,为企业提供思考方向。

InfoQ
算法论文8

模型长脑子了?研究发现LLM中层会自发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出型语言模型(LLM)学习中会自发演化出类似生物脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为模型可解释性开辟新路径。

机器之心
开源动态8

专为“超模型而生”,新一代训练引擎 XTuner V1 开源!

9月8日,上海AI实验室开源书生模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。

OpenMMLab
推荐文章7

深刻理解Token:语言模型(LLM)是如何看待这世界?

文章指出在语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越攻击越易,还对微调数据集实验,引发讨论。

InfoQ
8

AI教父Geoffrey Hinton,全球第二个百万引用科学家!

AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑模型运行。他还称模型是黑箱,领域待探索。

新智元
算法论文8

告别「利用率崩溃」:GIPO开启模型强化学习高效训练新方法 | ICML 2026

树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。

AI科技大本营
产品应用8

GPT-5.2技术炸场!6核心突破,办公效率拉满

OpenAI凌晨发布GPT-5.2,把专业级AI门槛拉到新高度。它有6核心技术突破,精准戳中职场痛点。在GDPval基准测试中表现出色,有三级模型矩阵,不同版本满足不同需求,各方面能力均有显著提升。

CourseAI
开源动态8

1.3万人收藏的 OpenHarness!港开源轻量级 Agent 基础设施,兼容性拉满!

近期,香港学数据科学学院团队开源项目 OpenHarness,它是 Agent 基础设施,有 Agent Loop、工具箱等亮点,功能特性丰富,支持多种模型提供商,还提供多种安装和配置方式。

开源星探
新闻资讯8

模型到智能体:50+ 头部企业的 AI 进化实践

2025年AICon全球人工智能开发与应用会6月27 - 28日在北京举办,50余家机构专家围绕AI Agent等前沿技术探讨落地实践与趋势。极客邦等企业代表分享应用布局,还有5主题演讲、14个技术专场和50多个标杆案例。

InfoQ