中科大」共找到 6894 篇相关文章

产品应用8

揭秘超节点,AI算力需要“统一的语言”

AI模型热潮带动算力行业发展,国AI芯片崛起,但单颗芯片算力不足、不同设备沟通有障碍成行业难题。华为发布“超节点”架构与“灵衢”技术,搞出“算力普通话”,目标是让算力系统更高效、灵活、省钱。

芯师爷
算法论文8

LLM应用测试范式的进化

文章指出传统软件测试方法在LLM应用存局限,探讨将其与AI评估结合应对挑战。抽象出LLM应用三层架构模型,分析传统测试范式适用性,介绍AI安全分析方法,阐述测试挑战、范式转变及协同测试策略。

AI与安全
算法论文7

从数据分布视角,重新认识下CoT

本文从数据分布视角重新审视语言模型的思维链(CoT)推理。指出CoT并非真正推理,而是模仿,其效果受训练与测试分布差异影响。通过实验揭示CoT在分布偏移时性能退化,提醒勿过度依赖。

深度学习自然语言处理
开源动态8

快手在 AI 上,渐入佳境

文章介绍快手多模态模型 Keye-VL 1.5,参数 8B 适合小企业。它侧重短视频场景,视频理解能力强,能与业务结合,提升推荐等场景效率。还详述其架构、预训练、后训练及训练架构优化等技术细节。

MacTalk
新闻资讯8

MLLM集体翻车,缺乏婴儿级常识!业界首个核心认知基准发布,LeCun转赞

当前模型在12项核心认知上普遍落后人类10 - 30%,越的模型越易靠「背答案」糊弄。团队公开首个系统评测框架和题库,用Concept Hacking方法识破模型真假理解,指出模型存在核心知识缺失等问题。

新智元
新闻资讯7

Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情

Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力

量子位
算法论文8

颠覆搜索引擎,下一代Agentic Deep Research!12家顶尖学术机构联手提出

在信息获取方式变革背景下,12家顶尖机构联合发布论文提出Agentic Deep Research,它由模型驱动,可自动规划检索路径等,或颠覆传统搜索范式,且有基准成绩和TTS Law支撑,开源生态也在聚焦。

新智元
算法论文8

新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%

研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务表现出色,是扩展模型能力新范式。

机器之心
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

文(深圳)和上海交通学团队提出 StreamBP 算法,通过线性分解和分步计算,将语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最序列长度为其 2.8 - 5.5 倍,代码已开源。

机器之心
新闻资讯8

72小时AI生存挑战,发生了什么?

五源发起72小时AI生存挑战,7位不同背景参与者在封闭空间,仅用AI工具和100元资金生存并创造。有人训练AI朋友,有人创作作品。过程暴露诸多问题,也让家看到AI能力边界与未来可能。

五源资本 5Y Capital