推理性能」共找到 3456 篇相关文章

推荐文章8

69 页最新报告丨AI Agent 圣经:智能体的终极指南

AI Agent 定义下一轮科技创新浪潮,众多公司积极布局。CBINSIGHTS《AI Agent Bible》报告梳理其前景趋势,含六大预测与生态版图,解析市场格局等,还展示智能体重塑企业运营方式。

特工宇宙
开源动态8

Qwen开源版Banana来了!原生支持ControlNet

Qwen推出新图像编辑模型Qwen - Image - Edit - 2509,支持多图融合、增强单图一致性,原生支持ControlNet。还开源端到端全模态模型Qwen3 - omni,性能优异,功能丰富。

量子位
8

无限长、零掉帧!StableAvatar口型同步全新技术

当前音频驱动头像视频生成扩散模型合成长视频时难兼顾音频同步与身份一致,瓶颈在音频建模。复旦大学提出StableAvatar,首个端到端视频扩散Transformer,能无限时长生成,还介绍原理与演示效果。

带你学AI
产品应用8

Kubernetes环境中作业帮大模型服务流量调度优化实践

随着大语言模型应用渐广,Kubernetes 现有 Ingress 组件在大模型服务流量管理上有局限。作业帮提出创新调度方案,整合成模型网关,具备五项核心功能,提升了资源效率、稳定性和易用性。

InfoQ
产品应用8

ChatGPT长了手脚,AI不再是副驾,直接抢过方向盘

OpenAI昨夜发布ChatGPT智能体,它整合网站交互、信息整合、对话交互三项能力,能智能选最优路径完成任务。在多项评估中表现领先,还有多重安全措施。今日向部分用户开放。

AI工程化
新闻资讯8

12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看

谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。

量子位
新闻资讯8

突发!Opus 5.2深夜上线,RSI真来了?

Anthropic在Claude Code开启Claude Opus 5.2灰度测试,跳开5.1版本,解决了以往AI“偷懒病”,响应速度、输出质量大幅提升,同时曝光内部已用核武级Model 2编写代码,RSI或已来临。

新智元
开源动态9

SGLang 某些模型的 CUDA Graph 为什么会有上百条 decode cuda stream?

本文分析SGLang运行DeepSeek-V4.1时,CUDA Graph出现上百条decode CUDA流的问题成因,介绍开源PR的修复方案,分享了压缩profiler显示行数的实用脚本方法。

GiantPandaLLM
开源动态8

搜索智能体也需要「操作系统」:SearchOS 开源多智能体协作框架

人大和蚂蚁的 SearchOS 研究,给出搜索智能体在长程任务中问题的答案。它借鉴数据库理念,做了多项核心设计,在开放信息检索基准评测领先,已提供多种使用方式,值得长程调研尝试。

机器之心
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。

新智元