「3D基础模型」共找到 8762 篇相关文章
Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×
Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为大模型与知识库结合提供新范式。
唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力
大语言模型性能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线性化技术、硬件实现等内容。
GPT-5实锤,悄悄上线代号「龙虾」!版本号曝光,实测编程惊人能改屎山代码
代号「龙虾」的神秘模型在WebDev Arena现身,网友猜测是GPT - 5,提前试用者称其编程能力惊人,能改屎山代码。多位用户表示其在代码生成等方面超越Claude,OpenAI或已秘密测试。
不止AlphaFold,「药界ChatGPT」横空出世!华人女投资人深度揭秘
AI初创Chai Discovery宣布分子设计模型Chai-2重构药物设计逻辑,将抗体设计成功率从0.1%提升到16%,实现零样本设计。其联创认为这是范式革命,未来药神或成提示词工程师。
AI「第二章」开启,未来看应用与Agent!
文章基于对一线投资机构访谈,指出AI开启新篇章,模型投资降温,应用时代来临。还探讨DeepSeek与Manus影响、Agent发展路径、AI原生硬件等多领域现状与趋势,为创业者和投资人提供参考。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
十分钟出结果,陶哲轩用Gemini Deepthink帮人类数学家完成Erdős问题论证
Erdős问题网站专注数学研究与解答,收录厄尔德什提出的各类数学问题。11月20日,Wouter van Doorn提出反例,陶哲轩提交给Gemini 2.5 Deep Think,十分钟得到证明,他半小时转为基础证明。之后Boris Alexeev用Harmonic的Aristotle工具完成形式化。
AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用
GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。
数学家24小时驳回OpenAI攻破的猜想!“AI证对了每句话,但已跟原猜想无关”
OpenAI宣称其下一代AI模型推翻了Connes刚性猜想,第二天堪萨斯大学的J. L. Nielsen就发文回应,指出AI构造的群不满足附加条件,还逐行核对代码指出‘要证什么’有问题,强调人类审查对AI科研结果很关键。
14.8K Star!这个开源 Skill,一句话就能做出大厂级设计!
Anthropic 发布的 Claude Design 虽能在对话框生成网页,但需手动操作。有人据此开发了开源项目 Huashu Design,可在 agent 里打一句话,3 到 30 分钟就能拿到能交付的设计,还介绍了其功能、核心规则等。