全栈自研」共找到 2819 篇相关文章

算法论文8

华人团队终结Token危机:扩散模型数据潜力超回归三倍

最新研究发现,token数量受限下,扩散语言模型数据潜力超回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。

量子位
算法论文8

GPT-5点赞!八大顶尖机构发布「进化智能体」面综述

在2025年,大语言模型已演变为智能体,但现有智能体部署后难以适应变化。格拉斯哥大学等机构学者发布综述,系统梳理进化AI智能体核心框架与挑战,提出三定律,还介绍了优化技术、应用案例等,并指出未来方向。

新智元
算法论文8

Self-Forcing++:让回归视频生成模型突破 4 分钟时长极限

加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。

机器之心
产品应用7

怎么回事?刚被OpenAI收购,Windsurf就发了个己的模型

5月初,刚被OpenAI收购的Windsurf发布AI编程模型SWE - 1,该模型针对软件工程流程,核心是流动感知,实现人机然交接。它有三个系列,已上线可免费使用,开发灵感源于编辑器,在评估和实测中表现良好。

Founder Park
算法论文8

ICML 2025|如何凭「动补」实现100K生成3×加速?

在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。

机器之心
产品应用8

数字生活的原生入口:蚂蚁集团发布AI眼镜新技术框架gPass

日前,蚂蚁集团在2025 Inclusion・外滩大会发布球首个智能眼镜可信连接技术框架gPass,具备“安、交互、连接”能力,可解决AI眼镜生态痛点,已应用于部分品牌,未来将释放更多潜能。

机器之心
新闻资讯7

一手奶瓶一手键盘!新手宝妈产假氛围编程,研实用家庭App

新加坡宝妈Laura Zaccaria产假研家庭餐食规划App。她无编程背景,靠Cursor等工具学习。AI迭代快,她意识到要跟上,产假成我进化契机,提醒大家学习才能不被时代抛下。

新智元
推荐文章8

大模型推理加速链路:内存管理、编译优化、量化与并行策略

本文整理金煜阳博士在QCon大会分享。介绍大模型推理挑战,如规模增大、架构复杂。阐述算子优化、内存管理、量化、异构调度和并行优化方法,还介绍开源推理引擎赤兔在国产芯片的实践成果。

InfoQ
产品应用8

DeepSeek-R1升级V2版:Token成本低至原来30%

DeepSeek - R1 V2版维度升级,训练框架从‘单一RL’到‘多阶段协同优化’,推理能力从‘能推理’到‘会优化推理’,还提升了安可控性,适配生态,推出轻量级模型。

CourseAI
推荐文章8

AI大模型开发核心技术:从框架到部署的景解析

本文为开发者提供2025年AI大模型开发核心技术图谱,解析四大核心支柱技术。基础开发框架含深度学习与AI Agent框架;模型训练与微调有分布式训练、参数高效微调;推理优化含关键技术与主流框架;AI编程辅助工具分主流形态且有发展趋势。

AIGC开放社区