渐进式加载」共找到 698 篇相关文章

推荐文章7

Skills火爆之后,我收集并整理了最近全网火爆的Skills,拿走不谢~~~

文章介绍 Agent Skills,称其是 AI 助理的「使用指南」,技能分浏览、加载、使用三阶段加载,有快且轻、跨平台、易分享等优势。还推荐多个优秀 skills 及相关工具网站,提醒从业务出发看待它。

小华同学ai
算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的多模态大模型

多模态大语言模型“始终思考”模有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模退火训练和双模策略优化实现自动思考,在多评测中达SoTA,省资源且效果好。

深度学习自然语言处理
新闻资讯8

Transformer八周年!Attention Is All You Need被引破18万封神

Transformer已满8岁,其开创性论文《Attention Is All You Need》被引超18万次,掀起生成AI革命。它催生诸多前沿产品,让人类跨入生成AI时代,虽起初未受关注,但如今影响深远,谷歌态度也在改变。

新智元
产品应用7

在北京,总要去东城体验一次“数字幻境”吧

在北京东城,XR沉浸技术落地生根,打造出多种新型消费场景。王府井有裸眼3D大屏、元宇宙沉浸场等;前门大街的科技体验馆有VR沉浸体验剧;隆福寺有索尼探梦、XR艺术空间等科技玩法。

故宫以东
新闻资讯7

战火升级!奥特曼正杀入脑机接口,这次不用切脑

近日,奥特曼邀专家加入脑机接口创业公司Merge Labs,计划以8.5亿美元估值融资。它将采用非侵入技术,与马斯克Neuralink的开颅手术竞争,奥特曼曾投资Neuralink但不认同其侵入做法。

新智元
开源动态8

微软、哈佛开源创新优化器:全面超越Muon,提升大模型训练效率

随着大模型训练所需计算资源爆炸增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布训练同步完整梯度,在集中和分布场景都有高效表现,性能超Muon。

AIGC开放社区
开源动态8

离大谱!15k Star book-to-skill,我惊到了!!!

book-to-skill是将书籍、文档目录或多份资料转换成Agent Skill的命令行工具。它把资料拆成可按需加载的知识资产,有按需加载章节等优势,适合将常用知识编译成技能,不过也有一定局限性。

小华同学ai
推荐文章8

当顶级视频模型半衰期只有 30 天,fal.ai 为什么收入反而一年增长 60 倍?

在生成媒体技术发展背景下,fal.ai 作为生成媒体 infra 公司迅速崛起。它通过统一 API 与云端平台提供多模态模型调用能力,2025 年收入增长 60 倍并完成融资。文章解析其如何构建护城河及对行业发展的判断。

海外独角兽
产品应用8

小红书提出社交大模型RedOne 2.0:兼听、敏行

在SNS内容爆炸增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交大模型,采用以RL为核心的三阶段渐进训练方法,实验显示其性能优异,还能转化商业价值。

量子位
新闻资讯7

字节、快手、小红书之后,阿班押注下一代种草要从“围观”走向“体验”

Dreamova 创始人阿班在经历字节、快手、小红书工作后创业,定位 AI 时代「体验生活方平台」。他认为 00 后不满足围观种草,要自己体验。产品让用户将喜欢的生活方一键变成体验视频,可代入调整。

Founder Park