「GPU性能分析」共找到 3214 篇相关文章
一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度
今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。
AnyGen款新AI工具,专门解决打工人最头疼的3件事,Doc,PPT,Excel
字节跳动2025年12月在海外推出一站式AI协作工作台AnyGen,强调人机协作打磨。产品有文档、通用智能体、幻灯片、数据分析四个核心模块,能解决会议纪要整理、PPT制作等痛点,还与主流工具做了横评。
Java 世界的 MCP:将架构策略应用于 LLM 集成
文章指出大语言模型成企业架构组件,但当前集成脆弱。MCP 引入标准化方法,Java MCP SDK 能将其与企业架构融合。文中探讨 MCP 及其 SDK,分析其设计、应用、权衡等,还给出企业运营助手案例。
不得不说你的GEO优化的很好
白杨SEO结合自身经验,分享AI搜索优化GEO推广相关问题。包括第一步要确认业务、分析现状找真实需求;介绍确定精准意图词的方法;还阐述GEO与SEO关系及推广效果和转化挂钩的办法。
Resolve AI:为什么 AI SRE 领域有望诞生下一代 Datadog
文章分析了 AI SRE 领域发展现状,指出运维侧 AI 变革慢于开发侧。介绍了 Resolve AI 产品,包括多 Agent 机制、应用场景等,还提及融资、客户情况,对比了与 Traversal 差异,探讨了 AI SRE 未来趋势。
告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍
视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。
撕开AlphaFold的神话:这根本不是AI做出了科学,只是吃了几十亿堆出的数据红利
Dwarkesh Patel与Michael Nielsen探讨科学进步识别问题。以迈克耳孙 - 莫雷实验为例,指出科学进步常先于验证闭环。还分析牛顿、达尔文等理论,质疑AlphaFold科学性,探讨AI做科学难点及外星文明技术树等。
对话 Funloom AI吴同:拆了AI还能玩,算什么AI原生游戏?
本文对话Funloom AI吴同,探讨AI游戏现状与发展。以《青椒模拟器》为例,指出AI游戏潜力。介绍Funloom平台,能让用户轻松生成文字游戏,分析其与开源项目差异、商业模式及对AI原生游戏看法。
谷歌的DeepSeek时刻:LLM推理加速被干到了8倍
谷歌TurboQuant论文介绍量化算法,能为大语言模型和向量搜索引擎大规模压缩。可将大语言模型KV缓存内存减至少6倍、加速达8倍且精度零损失,还介绍其工作原理及实验结果。
西湖大学王东林团队论文:机器人需要“通古今,知未来”丨CVPR 2026
西湖大学王东林团队提出论文《HiF-VLA:Hindsight, Insight and Foresight for Vision-Language-Action Models》,介绍HiF-VLA模型,它以“运动”表达时间信息,实现稳定连续决策,性能提升且计算成本低,推动机器人从“看到就做”到“边想边做”。