选择性生成框架」共找到 3474 篇相关文章

开源动态7

DeepSeek推理再提速80%,V4正式版定档7月中旬

DeepSeek两天前开源DSpark推理加速框架,已在V4预览版在线服务跑真实流量,使生成速度提升60% - 85%。DSpark化解推测解码问题,在多模型超Eagle3和DFlash。V4正式版7月中旬上线,将引入峰谷定价。

AIGC开放社区
开源动态7

腾讯Youtu-agent 不会代码,也能搞定数据分析+深度研究+HTML报告

腾讯开源的Agent框架Youtu - agent灵活高性能,可用于数据分析等多任务。基于openai - agents构建,适配多种模型API等。突出优势是能自动化生成智能体及其配置,采用YAML配置方案,有内置‘元智能体’,还完全异步。

CourseAI
开源动态8

文档秒变演讲视频还带配音!开源Agent商业报告/学术论文接近人类水平

澳大利亚和英国多所高校团队提出多模态智能体PresentAgent,能将文档转化为配有语音讲解和同步幻灯片的视频演示。其模块化生成框架有可控性和领域适应性,评估显示它在各指标上接近人类水平。

量子位
算法论文8

如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26

AI视频生成技术发展迅速,现有检测方法难满足需求。最新综述提出「事实保真度验证」目标,梳理出视觉与语言双视角的四层检测框架,还分析了检测方法演进、评测指标和数据集,为AI视频检测提供落地地图。

新智元
开源动态8

SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」

腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。

量子位
算法论文8

语义分割别无脑用Argmax!港中文新算法:三行代码,推理速度提升10倍

香港中文大学提出全新算法框架RankSEG提升语义分割性能。传统方法用threshold或argmax生成掩码并非最优,RankSEG无需重训模型,加三行代码就能提高分割指标,还开源了工具包,其改进版RankSEG - RMA推理速度大幅提升。

新智元
开源动态8

对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA

浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。

新智元
产品应用7

30分钟轻松掌握Cursor,快速提升开发效率和体验

本文通过在WebX老项目实践,验证Cursor用AI大模型能高效生成符合老旧项目规范的代码框架,显著提升开发效率与体验。还介绍其页面区域、AI聊天区功能,通过实战演示展示提效过程,最后提及可与MCP结合及OpenAI开源模型部署方案。

阿里云开发者
产品应用7

数据合成篇|多轮ToolUse数据合成打造更可靠的AI导购助手

文章以租赁导购助理“小不懂”为例,介绍Tool Use训练数据合成方案。先分析训练数据的目标与难点,提出动态多智能体对话生成框架,阐述多轮数据、复杂问题合成及过滤方案,展示数据和模型效果,还提及未来工作方向。

阿里云开发者
算法论文8

无需验证器的RL:RLPR解锁LLM通用推理潜能

现有依赖强化学习与可验证奖励(RLVR)提升大语言模型(LLM)推理能力的方法,受限于领域特定验证器。本文提出RLPR框架,利用LLM生成正确答案的固有概率作奖励信号,实现无需外部验证器的通用领域强化学习,效果显著。

深度学习自然语言处理