「清华团队研究」共找到 4770 篇相关文章
Meta联合Google新作:语言模型到底“记”了多少东西?
Meta和Google合作的论文探讨现代语言模型对训练数据的“记忆”情况。研究发明新方法精确测量“记忆”量,发现模型记忆有上限且与参数线性相关,还揭示学习转折、隐私规律等重要结论。
以加代乘?华为数学家出手,昇腾算子的高能设计与优化,性能提升30%!
大模型落地面临推理难题,华为团队基于昇腾算力发布三项硬件亲和算子技术研究,包括以加代乘的AMLA算子、融合算子技术、SMTurbo加速技术,实现能效、协同和速度突破,未来将拓展应用场景。
SIGCOMM 2026 | 从「人眼看视频」到「AI理解视频」:北大提出面向AI的实时通信框架Artic
AI 正从「文字聊天」走向「边看边聊」,传统实时视频通信难以满足需求。北大团队提出 Artic 框架,重构码率自适应等,实验显示其能显著提升准确率、降低延迟。
虾、马之后,人类登场!这个霸榜GitHub项目火了
OpenHuman 是 tinyhumansai 团队构建的开源桌面 AI 智能助手,采用 GNU 许可证开源。它解决了 AI 助手失忆、集成碎片化等痛点,有记忆树、TokenJuice 等技术,目前在开源社区反响大。
训练数据枯竭怎么办?首篇「数据价值密度」综述理清思路
上海交通大学与上海人工智能实验室团队发布首篇「数据价值密度」综述。提出“数据价值密度”概念并定义,建立分类框架梳理现有工作,还指出该领域面临的挑战,为大模型训练提供指南。
AI“氛围编程”威胁开源,维护者面临危机
开源维护者正加速关闭外部贡献,因AI生成贡献量大质低。研究显示“氛围编程”会造成负反馈循环,降低软件可用性和质量。平台激励加剧问题,虽有应对策略但效果不佳。
ICU昏迷不醒,AI判决生死!取意愿平均值,细思极恐
美国华盛顿大学研究「AI代理人」,用算法预测昏迷患者生死意愿。虽初衷似是人道主义实验,但AI仅基于历史数据推断,易成社会偏见延伸,还会影响决策,掩盖真正意愿,引发伦理担忧。
Meta CTO打脸扎克伯格:首秀翻车全因致命bug,AI智商捉急、语音交互全面崩盘
Meta Connect开发者大会上,Meta发布三款智能眼镜,现场演示却屡屡翻车。扎克伯格将问题归咎于Wi-Fi,CTO Bosworth否认,称是资源管理和软件错误。网友对Meta解释不满,质疑团队能力。
长思维链里的推理步骤,哪些最关键?三招锁定LLM的「命门句子」
杜克大学和 Alphabet 研究者提出在句子层面分析推理痕迹,找出长思维链中关键步骤,提高 LLM 可解释性等。提出三种互补方法,还提供开源工具,研究为调试推理失败等提供可能。
何恺明首个语言模型:105M参数,不走GPT自回归老路
何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。