「推理模型瓶颈」共找到 8378 篇相关文章
视频扩散模型新突破!清华腾讯联合实现高保真3D生成,告别多视图依赖
清华大学联合腾讯提出Scene Splatter,基于视频扩散模型,从动量视角引导其生成满足三维一致性的视频片段,提升三维场景生成效果,解决了传统方法在单张图片重建三维场景的难题。
清华教授创业押注RSI,融资近4亿元,要做会自我进化的模型
本文报道清华AI学院助理教授陈勇超创办超衍智能,押注递归自我改进RSI方向,打造可自主研究、自我进化的下一代基座模型,公司成立不到三个月完成近4亿人民币融资,已公布多项阶段性研究进展,全球多家机构已布局该赛道。
大模型已经够聪明了,为什么 95% 的 AI 项目还是跑不出 ROI?
2026年AI落地现悖论,模型能力强但多数项目难有ROI,原因是数据未准备好。腾讯云在AI产业应用大会宣布升级全栈数据平台,推出DataBuddy,可在多场景实现对话即交付,解决数据问题助力AI落地。
顶级邪修|万字教程|教你速通豆包・图像创作模型 Seedream 4.0
火山引擎上线豆包・图像创作模型Seedream 4.0,支持图片生成、连续编辑等。它美学表现佳、支持中文,企业可通过火山方舟接入,个人今晚20:00可在指定渠道体验。文中还给出多种玩法及对应提示词。
TPAMI 2026 | 北大彭宇新团队提出CPL++框架,实现视觉定位模型的「自知之明」和「自我纠错」
北大彭宇新教授团队提出CPL及进阶版CPL++框架。CPL用单模态匹配构造伪标签,引入静态验证模块;CPL++进一步自监督升级,具备纠错能力。实验显示,CPL++缩小了弱、全监督方法性能差距。
AI-Infra-Auto-Driven-SKILLS v0.1.0:给 Codex / Claude Code 的推理框架工作流
AI-Infra-Auto-Driven-SKILLS v0.1.0 版本整理可用 AI Infra SKILLS 并补充说明,沉淀推理框架开发流程约束,适用于 Codex 和 Claude Code,包含核心技能、SOTA loop、OpenAI 目标和提示等内容。
新型开源端到端 AI 语音模型!Voila:195ms 超低延迟引领全双工对话!
Maitrix团队发布开源AI端到端语音模型Voila,以195ms超低延迟及全双工对话受关注。它功能强大,支持多语言,有多种使用方式,适用于多个场景,架构采用模块化设计。
AI记忆系统首获统一框架!6大操作让大模型拥有人类记忆能力
香港中文大学等团队发布AI记忆机制综述,首次构建统一框架,划分记忆类型,提出六种操作,探讨关键主题,还对比人类与AI记忆,指明未来AI记忆系统需突破瓶颈,迈向认知跃迁。
终于!OpenAI 开源了2款模型:gpt-oss-120b 和 gpt-oss-20b
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 开源模型,性能出色,如 120b 版本媲美 o4-mini,20b 版本能在笔记本甚至手机运行。采用 Apache 2.0 许可证,有多种特性与运行方式,还经安全分析。
阿里云CIO首次系统复盘:大模型落地的RIDE方法论与RaaS实践突破
阿里云智能集团 CIO 蒋林泉分享大模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。