「ERNIE-4.5-0.3B」共找到 4894 篇相关文章
华为中科大联创大模型低比特量化算法,1‰数据实现昇腾无损压缩7倍
华为诺亚方舟实验室联合中科大提出CBQ后训练量化方案,仅用0.1%训练数据实现大模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。
首个实时端侧部署世界模型,20万小时人类视频,BeingBeyond实现「两级跃迁」
4月14日,BeingBeyond发布具身世界模型Being - H0.7,将人类视频规模扩至20万小时,采用隐式推理范式,6项权威评测综合第一。还率先实现端侧实时部署,打通数据闭环,推动模型通用与专家能力跃迁。
Cohere融资36亿,AMD英伟达都投了!前Meta研究副总裁出任首席AI官
AI初创公司Cohere完成5亿美元融资,估值达68亿美元,由Radical Ventures等领投,AMD、英伟达等参投。同时,前Meta AI研究副总裁Joelle Pineau出任其首席AI官,Cohere专注企业AI赛道。
在WAIC现场,全球首个拥有「原生记忆力」的大模型亮相,但不是Transformer
在WAIC上,RockAI推出基于非Transformer架构Yan 2.0 Preview的多模态大模型,有原生记忆能力。它在性能指标上优势明显,其记忆机制接近生物方式,团队秉持理念推动离线智能,获硬件厂商关注。
创业三年半,23人的AI公司卖了30亿
投资界消息,英伟达超4亿美元收购加拿大AI初创公司CentML,将其19人团队收入囊中。CentML由95后华人博士王尚及导师创立,以‘张量编译器Hidet’为核心技术,降低AI训练成本。
小扎千亿挖人名单下一位:硅谷华人AI高管第一人
扎克伯格带队重金诚聘AI人才,还想召回旧部。其中Bill Jia是硅谷大厂AI领域职级最高华人,2023年从Meta转投Google。Meta今年Llama 4发布遇挫,正重组团队、成立实验室并大量挖人。
新鲜出炉!斯坦福2025 CS336课程全公开:从零开始搓大模型
斯坦福大学2025年春季CS336课程“从头开始创造语言模型”课程和材料全公开。介绍了讲师信息,课程目标是引导学生开发语言模型,含5单元19门课,注重实践,还说明了学习该课程需具备的能力。
我让10个大模型又参加了完整版数学高考,第一名居然是它。。。
作者让10个大模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题大模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。
加速量子计算到来!英伟达开源模型拉爆量子计算股
英伟达发布并开源全球首个加速量子计算应用的模型系列Ising,打破硬件校准和纠错耗时难题,提供比传统方法更快、更准的量子纠错解码能力,还推出校准基准测试,全方位开源吸引众多机构加入。
显存暴降92%!哈工大为线性注意力开辟了新道路
哈尔滨工业大学等团队发现线性注意力性能不足根源是查询范数丢失等。基于此提出NaLaFormer,在ImageNet - 1K准确率最高提7.5%,超分任务峰值内存降92.3%,为线性注意力发展开辟新道路。