长上下文场景」共找到 2936 篇相关文章

开源动态8

1.9K Star 微软开源TTS王炸!90分钟超语音合成,4人对话自然切换!

在文本转语音(TTS)领域,生成篇、多说话人的高质量音频一直是技术挑战。微软最新开源的VibeVoice TTS模型,可一次生成90分钟连续语音,支持4个不同说话人,还具备高效处理序列等亮点特性。

开源星探
推荐文章7

企业数字化转型新引擎:MCP + LLM + Agent 架构赋能!

本文介绍MCP(Model Context Protocol)模型上下文协议,它是Anthropic于2024年11月底推出的开放标准,可统一大模型与外部数据源和工具通信协议,打破数据孤岛,有诸多优势,还适用于多个场景

MCP Server
新闻资讯7

并行革命,32倍吞吐量跃升!英伟达Helix架构突破百万Token推理瓶颈

英伟达推出受DNA结构启发的Helix并行技术,能解决大模型处理任务时的卡顿问题,提升上下文度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。

新智元
产品应用8

深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案

「豆包工作」作为面向生产力场景的Agent产品正式发布,与飞书深度打通,给出了目前Agent进入组织的最佳答案。主流办公Agent基础能力趋同,企业上下文正成办公Agent分水岭,豆包工作+飞书优势明显。

量子位
产品应用8

Token烧不起了?比肩Claude Opus 4.6免费模型来了,还将开源

昆仑万维旗下天工AI发布SkyClaw - v1.0,为Agent场景深度优化,免费试用后将开源,价格低。性能超同级别开源对手,逼近闭源巨头。训练围绕环境构建、数据合成、强化学习展开,适合链路Agent工作流。

AIGC开放社区
产品应用8

更可靠的主播助理:淘宝主播Agent的Harness工程实战

文章聚焦淘宝主播Agent的Harness工程实战。介绍了Harness基础定义与分层结构,阐述上下文工程、工具调用等八项实战内容,还提及记忆体系特色,强调Harness工程是让主播Agent可用、可控、可演化的关键。

阿里云开发者
算法论文7

“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%

多模态文档视觉问答常见于科研论文等场景,现有技术路线有大视觉 - 语言模型直接端到端和检索增强生成,但各有缺点。MMRAG - DocQA引入新方案,解决多模态连接和跨页证据链接问题。

PaperAgent
产品应用8

美团龙猫LongCat技术升级!新注意力机制解码速度快10倍,还能处理1M超文本

美团龙猫LongCat系列发布全新稀疏注意力机制LoZA,重点解决文本任务难题。它在MLA机制基础改造,计算复杂度降至线性,处理128K上下文解码快10倍,性能不缩水,后续还计划支持动态稀疏比例。

量子位
新闻资讯7

智驾新玩家首秀,“含模量”将成为新标准|甲子光年

9月28日千里科技召开首次品牌发布会,董事印奇展示智能辅助驾驶系统能力。其角色从定点车企服务商变为全车企伙伴,首创‘含模量’概念,还公布‘千里计划’,欲构建跨场景智能服务体系。

甲子光年
开源动态7

Ultralytics & lightly-train:简化计算机视觉模型训练,无需标签

在计算机视觉领域,获取带标签数据成本高、耗时。开源项目 lightly-train 用未标记图像和视频自监督预训练,减少标注成本与时间,可集成到现有训练管道,支持多种模型架构和应用场景

机器学习AI算法工程