优化过程」共找到 1496 篇相关文章

产品应用8

英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生

英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。

新智元
推荐文章7

面对MCP"工具投毒",我们该如何应对

近期MCP爆火但安全风险显现,安全机构指其有严重漏洞,会致‘工具投毒攻击’。本文介绍通过客户端/服务器代码复刻攻击过程,剖析MCP客户端和服务端安全风险,还给出阿里云的两种安全监控方案。

阿里云开发者
开源动态8

用多模态LLM超越YOLOv3!强化学习突破多模态感知极限|开源

华中科技大学、北京邮电大学等多所高校研究团队共同推出纯多模态开源LLM——Perception-R1,该模型用强化学习优化视觉感知,目前论文和代码均已开源,其在视觉任务上表现出色,为后续研究提供强大baseline。

量子位
新闻资讯8

2亿枚AI芯片大爆发,人类最大基建集体开工!

全球投入使用的AI芯片总算力相当于约2000万枚英伟达H100芯片,预计到2028年底达2亿枚。数据中心进入百万级算力时代,投入资金巨大。算力提升使模型和Agent能力增强,AI还参与自身研发优化

新智元
推荐文章7

公司官网没用了?AI搜索让它变得前所未有的重要!

本文围绕AI搜索时代公司官网的重要性展开。指出国内官网流量减少是因搜索流量迁移,而在AI时代官网成重要信源。还阐述官网作用变化、AI友好内容标准、页面优化重点及应注重信任标签。

白杨SEO优化教程
产品应用8

Token烧不起了?比肩Claude Opus 4.6免费模型来了,还将开源

昆仑万维旗下天工AI发布SkyClaw - v1.0,为Agent场景深度优化,免费试用后将开源,价格低。性能超同级别开源对手,逼近闭源巨头。训练围绕环境构建、数据合成、强化学习展开,适合长链路Agent工作流。

AIGC开放社区
产品应用8

国产新模王Qwen3.7-Max,海外开发者已经沸腾了

阿里通义千问团队发布的 Qwen3.7-Max,或为面向 Agent 时代的旗舰模型。它能自主跑 35 小时、完成 1158 次工具调用,内核优化不掉线,多项评测领先,应用场景丰富,已上线且兼容主流框架。

AIGC开放社区
算法论文8

ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架

西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。

AINLPer
算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。

PaperAgent
开源动态7

Coding Agent 的一个啊哈时刻

作者翻用Codex在SGLD做Qwen - Image/HunyuanVideo的modelopt fp8支持的记录,发现Coding Agent思考过程与人类思路高度一致,如对比中间图和结果图判断量化精度,Infra领域核心技能或被其解决。

GiantPandaLLM