交互轮次扩展」共找到 1046 篇相关文章

新闻资讯7

并行革命,32倍吞吐量跃升!英伟达Helix架构突破百万Token推理瓶颈

英伟达推出受DNA结构启发的Helix并行技术,能解决大模型处理长任务时的卡顿问题,提升上下文长度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。

新智元
算法论文7

清华-腾讯联手:音频 - 视觉多模态任务统一框架

Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。

CourseAI
推荐文章8

解读|生产级RAG系统落地的10个经验教训

本文解读Douwe Kiela分享的企业级RAG系统实施十大经验,如要有系统思维、专业化优先等,还推荐新作《MCP原理揭秘与开发指南——构建可扩展的AI智能体》。

AI大模型应用实践
算法论文8

逐个token太慢!大模型原生并行出token,CMU、英伟达新作Multiverse

卡耐基梅隆大学(CMU)和英伟达研究者提出Multiverse,这是能实现原生并行生成的新型生成模型。它解决了现有并行生成模型缺乏连贯性等问题,通过多方面协同设计构建推理模型,还开源了生态系统。

机器之心
开源动态7

从browser-use 出发,品 Agent 实现

本文作者以学习总结视角,从browser - use出发解析Agent实现。介绍LLM不同阶段,阐述Agent记忆、规划、工具等要素,通过对话演示和源码分析展示运行机制,还探讨MCP集成和Coze space应用模式。

阿里云开发者
8

奇绩创坛 2025 春季路演:Agent、具身、Infra、AI4S,57 个项目完整介绍

奇绩创坛2025年春季创业营路演日,57家公司参与。项目集中在场景智能、空间/具身智能等方向,覆盖AI Agent、智能硬件等赛道,还展示了前沿科研和创业项目。文章介绍了各项目的一句话介绍、简介和团队情况。

Founder Park
新闻资讯7

危险?OpenAI 模型行为负责人:人类很快会进入「AI意识」,当前最重要是控制人机关系的影响

OpenAI模型行为与政策负责人Joanne Jang发文指出,与其争论AI是否有意识,不如关注其对人类“情感福祉”的影响。文章探讨了OpenAI在人机关系上的处理,以及如何塑造模型行为,还提及未来计划。

AI寒武纪
开源动态8

DGM:首个可通过重写自己的代码来实现进化的AI Agent

Sakana AI发布Darwin Gödel Machine(DGM),可通过重写代码自我进化,突破了当前AI Agent智能固定的局限。它在多测试中表现出色,能力具通用性,但也有潜在风险和局限,团队已开源并提出未来研究方向。

AGI Hunt
开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
产品应用8

字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA

5月13日,火山引擎在上海发布5款模型和产品,其中豆包1.5・视觉深度思考模型(Seed1.5-VL)最吸睛。它激活参数20B,性能与Gemini2.5 Pro相当,38个评测基准达SOTA,推理成本低,已开放API。

机器之心