「ERNIE-4.5-0.3B」共找到 4871 篇相关文章
矩阵乘法可以算得更快了!港中文10页论文证明:能源、时间均可节省
香港中文大学10页论文提出新算法RXTX,用于计算矩阵与其转置的乘积XXᵗ。该算法结合机器学习搜索和组合优化技术,能源可节省5%-10%,时间节省5%,对多领域有深远影响。
蚂蚁阿福:从 0 到生产的医疗 Agent 工程化落地|QCon 北京
4月16 - 18日QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题,有百余落地案例。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程化落地》,探讨构建技术体系等内容。
AI最尴尬的短板,中国科学院出手了
7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。
蚂蚁阿福:从 0 到生产的医疗 Agent 工程化落地|QCon 北京
4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。蚂蚁集团郭春晓将分享《蚂蚁阿福:从0到生产的医疗Agent工程化落地》,探讨技术体系与布局,还有20多个专题论坛。
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。
华为创造AI算力新纪录:万卡集群训练98%可用度,秒级恢复、分钟诊断
大模型落地需强大算力集群支撑,构建万卡级算力集群是顶尖挑战。华为昇腾万卡算力集群近乎‘永不罢工’,其公开技术秘密,提出‘3+3’双维度技术体系,多项指标表现优异。
Gemini 2.5 Pro 负责人:最强百万上下文,做好了能解锁很多应用场景
谷歌DeepMind长上下文预训练联合负责人Nikolay Savinov在播客中分享Gemini 2.5长上下文技术。他认为长上下文能革新产品交互,与RAG协同,未来千万级token上下文将成标配,但当前百万级未达完美时扩规模意义不大。
MIT给微型机器人做了颗芯片,功耗仅6毫瓦,能实时3D建图
麻省理工学院研究团队开发出名为 Gleanmer 的微型芯片,功耗仅 6 毫瓦,能实时生成三维占据地图。它解决了机器人导航核心问题,通过多项优化提升性能,或让小设备拥有空间理解能力。
对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA
浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。
5位华人联创全走,创始12人只剩3人,马斯克xAI梦碎?
xAI的五位华人联创全部离开,其创始人正经历离职潮。公司并入SpaceX 、剑指万亿估值IPO ,资本压力下或致人员变动,马斯克将换人重建,效果未知。