中科大」共找到 6794 篇相关文章

开源动态8

首个完整开源的生成式推荐框架MiniOneRec,轻量复现工业级OneRec!

中科大LDS实验室与Alpha Lab团队联合开源MiniOneRec,是生成式推荐首个完整端到端开源框架。它验证生成式推荐Scaling Law,可轻量复现OneRec,提供一站式训练与研究平台,技术优势明显。

机器之心
算法论文8

对抗KV Cache压缩的脆弱性:两行代码以最坏风险控制防御底层假设崩塌

中科大团队在 ICLR 2026 论文指出 KV Cache 压缩领域底层假设存在缺陷,主流方法基于的稳定性假设在真实场景脆弱。团队提出防御性聚合策略,仅两行代码修改,显著提升 KV Cache 压缩性能。

机器之心
新闻资讯8

王小川:医疗行业对模型有三刚性要求,但通用模型一条都不达标

5月22日百川智能展示医疗模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用模型用于医疗有问题,医疗对模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。

Founder Park
新闻资讯7

《AI模型与异构算力融合技术白皮书》正式发布

10月10日,算网等联合发布《AI模型与异构算力融合技术白皮书》,聚焦模型开发痛点,为开发者提供技术参考。白皮书介绍全球模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。

AIGC开放社区
算法论文8

年度AI论文!全球三顶尖模型的防蒸馏机制全面告破:小模型“套出”模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复模型隐藏思维链数据。还揭示部分模型训练或借鉴模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
推荐文章7

数据到好猜想:如何用模型做市场研究?

文章指出模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park
新闻资讯8

微软分享三王炸算法:突破模型推理瓶颈,性能

今天凌晨微软官网分享三创新算法,即rStar - Math、LIPS、CPL,可助模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。

AIGC开放社区
新闻资讯8

硬核「吵」了30分钟:这场模型圆桌,把AI行业的分歧说透了

在WAIC 2025模型论坛的“模型之问”圆桌,多位行业佬围绕模型展开辩论,话题涉及训练范式、模型架构、数据、开闭源等核心问题,不同观点碰撞,深入探讨模型技术演进与发展之路。

机器之心
算法论文8

ICML 2026 | 模型内部也会长出「情绪树」,规模越越懂人心

ICML2026 论文指出,语言模型内部会自然形成类似人类心理学模型的「情绪树」,模型越,情绪树越复杂,且在销售等任务上表现更好。同时,模型的情绪结构受身份设定影响,存在与人类相似的情绪识别偏见。

机器之心
算法论文8

只需一次指令微调,模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙与Thomson Reuters团队提出SIMoE,单阶段微调就能升级模型,还解决传统方法两局限,在性能和效率上双突破。

量子位