核心任务」共找到 3498 篇相关文章

算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。

GiantPandaLLM
算法论文8

GUI智能体训练迎来新范式!半在线强化学习让7B模型媲美GPT-4o

浙江大学与通义实验室团队推出UI - S1,提出半在线强化学习训练范式。它融合离线与在线学习优势,用三项关键技术构建核心架构,新评测指标SOP更贴近真实表现,实验显示UI - S1 - 7B性能卓越,逼近GPT - 4o。

量子位
算法论文8

斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。

深度学习自然语言处理
新闻资讯7

GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够

OpenAI 发布 GPT - 5 进军企业市场,虽发布不顺利,但部分初创公司和企业客户反馈其在复杂任务表现出色、价格低廉。OpenAI 联创 Greg Brockman 揭秘 GPT - 5,称其代表‘几乎难以形容的智能’,是科研好伙伴,还探讨算力、模型训练等问题。

InfoQ
新闻资讯7

快来看看GPT-5第一波实测

GPT-5发布引全球关注,50万粉Youtuber Matthew Berman用25分钟视频展示其近30个任务表现,如做出魔方生成器、复刻网页版Word和Excel等。它多项能力有提升,但也有不足,被马斯克质疑,还因‘52>69’名场面遭吐槽。

量子位
开源动态8

刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!

小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元
新闻资讯8

我在WAIC看见的十大趋势

上海世界人工智能大会(WAIC)热度空前,一票难求。本文总结了WAIC呈现的十大核心趋势,如中国AI因DeepSeek而不同,开源大模型进入中国时间,AI创新来到ToC阶段,第一批商业化AI终端是汽车、耳机和眼镜等。

量子位
新闻资讯7

杭州闯出40亿AI医疗IPO!阿里CEO多轮投资

杭州AI陪诊公司微脉准备赴港IPO,其创始人裘加林经验丰富。微脉依托自研CareAI平台,以与公立医院合作为核心开展全病程管理服务,业务增长可观,虽仍亏损但在收窄,此次募资用于AI能力提升和业务扩张。

量子位
开源动态8

256块NPU训成8B视频模型、超越Sora等一众闭源!抖音内容技术团队开源ContentV

近日,抖音内容技术团队开源ContentV,这是面向视频生成任务的高效训练方案。用256块NPU约4周训成8B参数模型,在多评估维度效果与主流方案相近,还探索了有限算力下训练路径,现推理代码与权重已开放。

机器之心
算法论文8

GPT-4V仅达Level-2?全球首个多模态通才段位排行榜发布,General-Level打造多模态通用AI评测新范式

General-Level团队提出全新评测框架General-Level和数据集General-Bench,构建超大规模评测基准和多模态通才模型排行榜。其用五级段位体系衡量模型通才能力,General-Bench覆盖多模态任务,排行榜分多层次榜单,目前各模型段位差异大,Level-5空缺。

量子位