「单轮对话」共找到 561 篇相关文章
ICCV 2025 | SeaS: 工业异常生成+正常合成+精准掩码大一统框架,指标全面碾压SOTA
华中科技大学慢工团队提出少样本工业生成模型SeaS,依托U-Net,只需1 - 3张训练样本,单模型同步实现多样异常生成、正常产品合成及精确异常掩码标注,突破现有方法局限,在主流数据集上超越SOTA。
马斯克终于成『AI No.1』,6大案例看实力与水分
马斯克发布Grok 4,宣称其超越OpenAI等LLM。它屠了各种榜单,但Grok系列口碑欠佳。文中通过多案例测试,展现其在各方面的表现,如编码、数学、图像等,还提到了API速度和价格。
【博客转载】Row-Major VS Column-Major
文章探讨行主序和列主序存储多维数组的差异,以及对矩阵乘法性能的影响。指出不同存储顺序组合下矩阵乘法的偏好,还通过C++单线程实现和cuBLAS库验证分析,表明优化可减少性能差距。
智能体请求暴增 9.4 倍,token 账单却没涨:Uber 公开 AI 软件工厂省钱方法
AI 工具已嵌入 Uber 软件开发各阶段,智能体请求量增长 9.4 倍,但 AI 总支出自 4 月相对稳定。文章介绍其软件工厂思考,包括智能体会话层级、成本公式、指标测算及优化手段,还提及未来举措。
5秒完成3D场景编辑,北大&港中文&上海AI Lab搞出VGGT-Edit,120倍加速太炸了
北大、港中文等团队提出原生3D编辑框架VGGT-Edit,不再绕回2D,直接在3D空间编辑。它采用残差场预测等机制,在DeltaScene测试集表现出色,单次编辑约5秒,最高120倍加速。
腾讯开源Cube Sandbox:60毫秒冷启动的AI沙盒运行时
Harness设计中沙箱是重点难点,传统方案在安全与性能间妥协。腾讯开源Cube Sandbox,用RustVMM重构虚拟化层,冷启动60毫秒,单实例5MB内存开销,有真内核隔离等优势,开源版本含网络隔离组件。
Turso:用 Rust 重写 SQLite,让数据库跑在每一个边缘节点
Turso用Rust重写SQLite内核,解决其单写者限制和缺乏网络同步能力的短板。它有嵌入式副本、边缘同步和向量搜索等特性,适用于AI Agent、多租户SaaS等场景,与竞品相比优势独特。
MiniMax M2.7国服第一!龙虾自我进化,海外开发者疯狂刷屏
MiniMax M2.7发布后在全球开发者社区引发巨大反响,在PinchBench榜单上拿下全球第四、国产第一。它具备多智能体协作、自进化等能力,在代码、办公、科研等场景表现出色,还推出开源项目OpenRoom。
视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26
清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。
腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?
最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。