优化训练」共找到 3104 篇相关文章

新闻资讯7

英伟达为何持续押注VASTData?AI存储正在成为新的“算力”|甲子光年

AI产业曾聚焦GPU,如今数据存储设施重要性凸显。VAST Data完成约10亿美元F轮融资,估值300亿美元,英伟达持续跟投。它重构AI数据基础设施,国内焱融科技有相似技术路线且具自主可控优势。

甲子光年
算法论文8

何恺明首个语言模型:105M参数,不走GPT自回归老路

何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。

量子位
新闻资讯8

超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官

5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。

AI科技大本营
开源动态8

开源SOTA!商汤原生多模态一个大脑完成看图、推理、作画

商汤开源日日新SenseNova U1,用NEO - unify架构让像素和文字自由协作,多项指标达开源SOTA,适配10家国产芯片。它能完成看图、推理、作画等多任务,虽有局限,但后续优化值得期待。

AIGC开放社区
算法论文7

论文解读:一个运算符能导出所有基本函数

波兰雅盖隆大学Odrzywołek发现二元算子EML,结合常数1能生成科学计算器所有标准功能。EML算子简化运算符集合、将离散问题转化为连续优化问题,但存在数值稳定性、表达式非唯一等局限。

力学与人工智能
产品应用8

20亿美金苏度科技具身首秀即大招!0真机数据,zero-shot,跑出98%首次抓取成功率

苏度科技发布软硬件全栈自研的机器人系统R1,采用世界模型与强化学习一体化设计,在不使用真机数据的前提下,实现关键任务近100%的Zero-shot成功率。苏度团队通过重新定义数据范式,解决了具身智能发展的核心瓶颈。

量子位
产品应用8

全球1100万台出货,追觅打造最聪明的扫地机

追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。

AI科技评论
新闻资讯8

Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现

Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。

花叔
开源动态8

你花80%精力调的AI,效果被 PDF 解析卡死了

做RAG时,花80%精力优化embedding和检索,效果上限却被PDF解析卡死。OpenDataLoader PDF靠不同架构在基准测试获第一,采用混合架构,还做了三件其他解析器不做的事,思路值得学习。

CourseAI
新闻资讯7

刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了

Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数级增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。

新智元