「3D堆叠技术」共找到 4487 篇相关文章
Ollama升级模型调度系统:内存管理更精准,多GPU性能提升
Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。
年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川
年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。
程序员从此不再写代码!红杉专访Codex团队,o3白菜价真相曝光
红杉专访OpenAI Codex团队,揭示AI编程未来。Codex从代码补全演化为智能体,强调委托心态,开发者从动手转向审核。还爆料OpenAI内部有递归自我改进的AI Alice。
通用级PixVerse P1的技术突破,揣着进入平行世界的密码
PixVerse R1 突然上线,带来「即时响应、即看即创」新体验。它是全球首个支持最高 1080P 分辨率通用实时世界模型,实现从「静态输出」到「实时交互」跨越,本文将解析其技术突破。
Data Agent 落地挑战:忽略技术框架、语义能力和运营体系,投入可能打水漂
Data Agent 看似易上手,落地却充满挑战。腾讯数据工程专家虎兴龙指出,90% 难点源于软件工程,统一语义层建设是关键。企业若忽略相关要点,投入或打水漂,掌握关键要素可提升数据智能化效率。
「OS产业报告」解读:国产操作系统的技术突围与生态跃迁之路
2025 龙蜥操作系统大会发布《国产服务器操作系统发展报告(2025)》,预测未来三年国产 OS 国产化率将升至 65%、市场规模破 300 亿元。「AI 进化论」第七期邀请专家解读报告,探讨国产 OS 的发展逻辑、技术突破与生态建设。
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了
上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。
并行革命,32倍吞吐量跃升!英伟达Helix架构突破百万Token推理瓶颈
英伟达推出受DNA结构启发的Helix并行技术,能解决大模型处理长任务时的卡顿问题,提升上下文长度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。
领域驱动的 RAG:基于分布式所有权构建精准的企业知识系统
银行技术供应商为解决文档和专业知识获取难题,探索用 RAG 技术,严格将 AI 作咨询工具。重新分配 RAG 实施所有权,采用元数据方法,探索伸缩性解决办法,构建完整应用并评估性能,结果令人振奋。
图灵奖大佬来听课,竟然只能坐地板!谷歌扫地僧有多离谱?
技术圈流传「Jeff Dean Facts」梗图/段子合集,把谷歌首席科学家Jeff Dean捧成传奇。其诞生于2008年,最初是玩笑,后升级为传说。他与Sanjay Ghemawat合作缔造谷歌技术基石,段子折射谷歌工程师文化。