「推理与计算」共找到 7989 篇相关文章
收官|近50万人次参与!首届北京艺术与科技周“热力值”拉满
12月7日,首届北京艺术与科技周在798艺术区收官。活动联合16+家机构,邀100+嘉宾,有100+场展演对话,近50万人参与。科技领袖对话、艺术先锋云集,还有多项原创首发,引25+家媒体关注。
AliSQL 向量技术解析(一):存储格式与算法实现
随着AI与大模型应用普及,向量存储与检索需求大增。AliSQL基于MySQL 8.0扩展向量处理能力,本文聚焦其向量索引,介绍存储格式、算法实现,如HNSW算法及插入、搜索等操作,还提及辅助表设计与DDL原子性。
推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限
大语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。
直播预约 | “年鉴展·艺术与科技”主旨演讲&研讨会第二场将于12月14日举行
“年鉴展·艺术与科技”展览正在798艺术区举行,展至12月19日。12月14日16:00 - 18:00将举办第二期主旨演讲与研讨会,朱青生主持,费俊、刘超、张彬彬将探讨艺术与科技多方面问题。
LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式
多数推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。
Andrej Karpathy 盛赞!斯坦福团队新作,让Llama-1B 实现毫秒级推理
斯坦福Hazy Research团队将开源模型Llama - 3.2 - 1B前向推理整合为“Megakernel”,把推理延迟大幅降低,显存带宽利用率显著提升。团队指出当前主流LLM推理系统在小batch、极低延迟场景下低效,提出Megakernel以重构执行方式。
中国团队重新定义“星际之门”!全球首个太空计算星座已实现常态化商用
中国国星宇航团队发射的太空计算星座,在第四届琶洲算法大赛中助力佳都科技团队完成交通行业算法上星运行,实现常态化商业运营,标志轨道AI计算进入工程化阶段。
妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒
斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。
AICon上海演讲精华回顾:《GMI Cloud 全球化高性能分布式推理服务构建实践》
AICon2025上海站,GMI Cloud资深架构师Frank Lee分享《GMI Cloud全球化高性能分布式推理服务构建实践》,介绍其推理平台,拆解扩缩容等能力,分享架构设计、部署及优化实践,揭秘推理提效关键路径。
无需多视角,单图重建可交互3D模型!南洋理工开源结构推理框架
南洋理工大学团队提出MonoArt,将单目可动物体重建建模为渐进式结构推理过程,通过四个关键模块逐步推理,无需外部先验,在PartNet - Mobility基准测试中表现领先,兼顾推理效率,还可用于下游任务。