端到端框架」共找到 3730 篇相关文章

算法论文8

近期,谷歌发了两篇Agent Scaling论文,有点东西

2025年LLM社区有Test - Time Scaling和Agent化两条主线,但‘更多agent是否更好’无人能定量回答。谷歌两篇论文将agent scaling拆成可预测、可度量的科学问题,涉及预算感知和多agent盈亏平衡点。

PaperAgent
新闻资讯8

上海理工男造芯,飙上3000亿

12月17日,沐曦股份登陆科创板,市值超3000亿。创始人陈维良出身AMD,放弃百万年薪创业。他带领强悍班底,精准切入B数据中心市场,产品落地快,还构建国产供应链,搭上AI东风加快追赶。

芯师爷
开源动态7

SGLang|SGLang Diffusion

来自SGLang开源社区的Yichi介绍SGLang Diffusion,它是面向图像与视频生成的全开源扩散模型推理引擎。基于SGLang机制将能力迁移扩散模型推理,能显著提速工作流,视频展示了多种功能。

GiantPandaLLM
开源动态8

欧洲版DeepSeek发布Mistral 3系列模型,多模态云生态,无差别商用交付给全球开发者

欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。

AIGC开放社区
推荐文章8

62岁软件教父Martin Fowler警告:AI泡沫下,裁员潮印证行业萧条,大模型正将编程拖入“非确定性深渊”!

62岁软件教父Martin Fowler在The Pragmatic Engineer节目中谈AI对软件开发的影响。他认为当下行业萧条,AI有泡沫,编程从确定性转向非确定性带来挑战,也催生新工作流程,还强调测试、重构等的重要性。

InfoQ
算法论文8

AI问答,直接「拍」给你看!来自快手可灵&香港城市大学

来自快手可灵团队和香港城市大学的研究者提出「视频作为答案」任务范式,发布VANS模型。它由视觉语言和视频扩散模型构成,通过联合分组相对策略优化算法协同优化,在教学和预测应用上效果超现有模型。

量子位
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。

AINLPer
算法论文8

AAAI 2025 Oral | 火山引擎多媒体实验室提出VQ-Insight,AIGC视频画质理解大模型

火山引擎多媒体实验室与北大合作论文《VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning》入选AAAI 2026口头汇报。VQ - Insight用渐进式框架处理AIGC视频画质理解,实验表现卓越。

机器之心
开源动态7

我用这个开源的「智能体记忆操作系统」,30分钟做了一个AI备忘录应用。

文章推荐开源记忆项目MemOS,它是为智能体打造的记忆操作系统,能让AI有长期记忆体系。作者用其30分钟做出AI备忘录应用,还介绍了MemOS框架,称它是AI转变的关键基建。

开源AI项目落地
新闻资讯7

千问APP悄悄上线,阿里的AI超级入口也终于来了。

阿里千问APP悄悄上线,界面简约,功能增加,支持Qwen全系列最新模型。它将阿里系分散的AI触点收束“千问”品牌,还默认开启搜索,整合多种功能,让普通用户使用体验更友好。

数字生命卡兹克