「推理技术栈」共找到 4711 篇相关文章
AI 驱动云上运维革命:腾讯云如何用“云顾问”重塑 SRE
在 AICon 大会上,腾讯云许小川介绍,面对云 IT 服务挑战,腾讯云推出「腾讯云顾问」可视化平台,涵盖架构梳理等功能。还分享多方面经验,用 AI 重塑 SRE,助力工作数智化升级。
如何选择最佳多模态大模型压缩方案?哈工大、度小满开源EFFIVLM-BENCH基准测试框架
金融科技智能化转型中,LVLM部署受算力瓶颈制约。哈工大与度小满联合开源EFFIVLM - BENCH基准测试框架,能为多模态大模型压缩方案出具‘体检报告’,还揭示LVLM加速复杂性,推动技术发展。
张鹏对谈李广密:Agent 的真问题与真机会,究竟藏在哪里?
本文是《今夜科技谈》直播沉淀,极客公园整理。拾象科技李广密、钟凯祺从多维度拆解 Agent 真问题与机会,探讨产品、技术路径、商业模式等,指出 Agent 发展方向与挑战。
MiniCPM 4.0来了!220倍极速狂飙,端侧模型的比赛,结束了
面壁智能联合清华发布MiniCPM 4.0,极限场景220倍加速。它是首个原生稀疏模型,有三级火箭推理加速体系,性能强,适配全平台,应用广泛,或成端侧AI分水岭。
“不用 Cursor和 ChatGPT、手写代码的开发者,怕不是疯了?”
本文围绕开发者是否应使用AI辅助编程展开讨论。支持者认为大模型能提升效率,解决琐碎问题;反对者则质疑其可靠性。文中还分析了大模型在编程中的优缺点,如能生成代码但也有幻觉等问题,并反驳了一些反对观点。
智元机器人发布并开源首个机器人动作序列驱动的世界模型
智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,解决具身智能演进制约,提升策略模型筛选与训练效率。
极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning
大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。
快手&中科院 | 提出多模态奖励模型:R1-Reward,比SOTA模型提升5%-15%!
多模态奖励模型对提升多模态大语言模型表现至关重要,但现有强化学习算法用于训练存在问题。快手、中科院等团队提出 R1 - Reward,在基准上比 SOTA 提升 5% - 15%,还在快手业务场景成功应用。
斩获18.3K star!再见Airtable,这款Postgres驱动的开源表格神器要火!太 6了
Teable是基于PostgreSQL的无代码数据库平台,被赞为Airtable开源替代潜力股。它有百万级数据秒级响应等亮点,具备独特技术架构,适用于多场景,与同类对比优势明显。
复杂的Harness Evolution,甚至不如多跑几遍
本文解读AI2与华盛顿大学最新研究,针对热门Agent Harness Evolution方向,通过公平对照实验检验方法真实收益,戳破研究误区,引发对Agent评估标准的反思。