「低资源语言」共找到 2346 篇相关文章
内存减6倍、精度0损失,推理提速8倍!谷歌新技术震撼了AI圈
Google Research团队推出TurboQuant技术,能将KV缓存6倍压缩、无精度损失,推理速度提升8倍,解决内存瓶颈问题,为大语言模型应用扫清障碍,引发业界关注,还致存储芯片巨头股价大跌。
Transformer 中的专家混合模型 (MoE)
文章介绍Transformer中专家混合模型(MoE),它能解决稠密模型扩展瓶颈。阐述其优势,如计算高效、适合并行等,还介绍在transformers库中支持稀疏架构的演进,包括权重加载重构、专家执行后端、专家并行及训练方案。
聊聊 Token 出海的生意经:模型开源给世界,中国赚什么?
本文围绕中国开源模型展开,介绍了 Cursor 使用 K2.5 模型事件,阐述了开源模型供应链,分析了中国开源模型受欢迎原因,探讨小公司技术机会,还提及开源面临的挑战及未来趋势,指出其正改变全球 AI 基础设施格局。
文言文秒杀所有大模型!100%攻击成功,轻松突破安全防线
南洋理工等机构团队提出基于文言文语境的自动化黑盒测试框架CC - BOS,利用果蝇算法和8维策略空间,暴露主流大语言模型安全盲区,实验显示对6款主流模型攻击成功率达100%。
马斯克要自己做「英伟达+台积电」!宇宙芯片宏图开工,算力产能扩5000%
马斯克宣布启动史上最大规模芯片计划Terafab,目标是每年生产超1太瓦算力,80%部署至太空。该计划将芯片设计到制造整合,为机器人、AI和太空数据中心造芯片,不过暂无具体时间线。
刚刚,清华团队养出了一只「龙虾老师」!教育版OpenClaw震撼开源
清华教育学院与计算机系联合团队开源多智能体AI课堂OpenMAIC。它能一键生成交互式课程,AI老师语音授课、AI同学互动。经两年真实课堂验证,支持主流大模型,有望成教育版ClawHub。
4B模型幻觉抑制能力超越GPT-5,CMU等提出行为校准强化学习新方法
大语言模型幻觉问题是部署难题,CMU等研究人员提出行为校准强化学习新方法,重新设计奖励函数。经训练,40亿参数模型幻觉抑制力超GPT - 5,实验证明该方法效果显著,还带来理论洞察。
CVPR 2026 | AI寒武纪时刻?字节世界模型新作,仅靠视觉学习真实世界知识
豆包大模型团队与北京交通大学联合提出视觉世界模型 “VideoWorld 2”,无需依赖语言模型,仅靠视觉信息让机器掌握复杂能力。它能完成复杂手工任务,成功率远超主流模型,代码与模型已开源。
《苏州市智能算力产业创新中心建设计划》正式发布
2月28日,《苏州市智能算力产业创新中心建设计划》发布。由移动云牵头,依托其资源联合各方打造开放式AI算力创新平台。立足苏州产业优势,确立‘1+3’架构,以OAS为核心,分三年推动产业化落地。
Tabbit浏览器实测:AI终于学会帮我上网干活了
本文实测Tabbit浏览器,它刚正式发布且免费。与Arc、Atlas不同,Tabbit切换成本几乎为零,有智能标签整理、妙招功能、Agent智能代理等,还内置多个国内外大模型,但脚本妙招和智能标签整理有改进空间。