推理智能体」共找到 5523 篇相关文章

产品应用8

AI生图迎来大升级:图像编辑达到像素级!背后团队大多来自Stable Diffusion模型基础技术发明团队

Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它以文本和图像为输入,有 Pro、Max、Dev 三版本,已在多平台上线,获用户好评,但也面临竞争。

AI前线
推荐文章8

荐系统进入“大模型时刻”:昇腾NPU如何支撑千亿级生成式荐落地

文章基于华为郭威在2025 AICon大会演讲,复盘华为荐技术探索。介绍FuXi-α、β模型设计,解决训练和理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
产品应用7

WorkBuddy杀疯了?一群AI专家帮我打工,我在微信里当赛博虾工头!

本文介绍腾讯出的全场景职场AI智体桌面工作台WorkBuddy。它内置多领域垂类专家,接管自媒体内容创作流水线,还接入微信ClawBot插件方便操作。部署和技配置门槛低,内置主流模型,还有免费Credits福利。

量子位
新闻资讯7

谷歌、Anthropic双重围剿下的OpenAI,正面临「生死抉择」

进入2026年,OpenAI将部分重心转向企业级市场,CEO奥特曼召集企业高管聚会,传达服务企业用户意向,还将新方案助企业AI转型。其发力企业市场,是因流量被谷歌等竞品追赶,似走到转型十字路口。

机器之心
产品应用8

顶级邪修再战 Nano Banana Pro ,超多玩法,太猛了这玩意!

谷歌发布 Nano Banana Pro 模型,将图片模型向顶峰,支持中文。它生成准确视觉内容、多语言文本,可混合多元素,支持多分辨率。经测试,其各方面表现出色,应用场景丰富,版权限制宽松,三方应用和谷歌官方均可使用。

歸藏的AI工具箱
开源动态8

清华等发布UltraRAG 2.0,仅用50行代码解锁RAG高性开发

大语言模型存在“知识截止”问题,RAG技术应运而生,成为大模型落地主流方案。但随着需求提升,其工程实现变复杂。清华等出UltraRAG 2.0,仅50行代码实现同等功,降低开发门槛,性提升,还落地多种场景。

AIGC开放社区
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉力贼强~

智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉理强,经测试助力科研各阶段,还介绍了其架构设计与训练策略。

CourseAI
推荐文章7

最高提升7倍?探究大语言模型理之缓存优化

文章探讨大语言模型理缓存优化技术演进与未来展望,介绍了主流理框架vLLM、SGLang,分析KV Cache、Paged Attention、Prefix Caching等技术的优化点,还提及LMCache、DeepSeek的缓存技术,最后提到MCP赋可视化OLAP智体应用。

阿里云开发者
算法论文8

One RL to See Them All?一个强化学习统一视觉-语言任务!

国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性提升显著,凸显统一 RL 方法有效性和可扩展性。

机器之心
新闻资讯7

宇树背后的供应链赌局:不怕错,怕空|甲子光年

文章介绍新安,作为宁德时代和新源科技合资子公司,在多领域成龙头。它凭借技术积累切入人形机器人电池赛道,给宇树供货,试图建立标准,虽赛道有泡沫和风险,但提前布局或占先机。

甲子光年