「迭代优化能力」共找到 4553 篇相关文章
狂揽33.8K星!这款Postman替代工具,绝了,离线+Git协作太香
Bruno是开源API探索测试IDE,有自研Bru语言、离线存储和Git协作能力,是Postman等强力竞争者。它功能丰富,有跨平台支持等,技术架构优势明显,还给出实战演示和同类工具对比。
英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生
英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。
MCP进阶:一键批量搞定MCP工具部署
在AI应用复杂当下,传统MCP工具集成有痛点。文章提出基于阿里云计算巢的一站式方案,可多MCP工具批量部署,首创双通道调用能力,还介绍部署、使用、增减工具及问题排查等内容。
ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍
LLM生成文本时KV Cache内存占用高,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独高精度保存,其余压缩。实验显示,它准确性高、效率好,不过在极短文本等场景有局限。
AI长身体,直接做实验!自主通用科学家,科研界的Scaling Law来了
本文探讨未来科研范式「自主通用科学家」(AGS),它将AI与机器人技术结合实现科研全流程自动化,有望突破人类科研限制,引发科学范式变革,还介绍了相关架构、优势及面临的挑战和应对策略。
大模型推理上限再突破:「自适应难易度蒸馏」超越R1蒸馏,长CoT语料质量飞升
本文从中兴通讯无线研究院「大模型深潜」团队切入,介绍了首创的「LLM自适应题目难度蒸馏」方法,该方法围绕「模型 - 数据动态匹配」提出了一条完整的CoT构建流程,显著提升了长CoT语料的质量。
用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源
华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。
不受控的 Agent ,凭什么上生产系统?
本文探讨AI Agent落地企业生产系统的核心痛点:Agent输出失控风险高,指出模型能力不代表落地可用性,介绍了业内首套以评估为核心的Agent全生命周期部署方法论Agent DLC,附真实落地案例。
AI 边说边画,200+ 模板自动出图,蚂蚁这个项目有点东西!
本文介绍蚂蚁集团AntV可视化团队开源的Infographic项目,这是专为AI生成优化的声明式信息图可视化引擎,支持AI边生成内容边渲染出图,内置200+模板,解决作图排版痛点,已形成开源生态。
本地该怎么做RSI?我们与StartLux CTO聊了聊
菲尔兹奖得主联名信引发AI数学研究争议,前沿研究开始防备云端AI,但本地AI能力不足。本文专访StartLux CTO郭权玮,深度讨论本地RSI实践路径,披露Auto Research方法、实验数据与安全方案,介绍本地模型研发进展。