新全栈」共找到 5133 篇相关文章

新闻资讯8

刚刚,英伟达模型上线!4B推理狂飙53倍,注意力架构超越Mamba 2

Jet - Nemotron是英伟达推出的小模型系列(2B/4B),由华人团队打造。其提出PostNAS与JetBlock,实现架构优化。相比Qwen3等模型,它在多维度准确率更高,H100 GPU上推理吞吐量最高提升53倍。

新智元
开源动态8

ICML 2025 | 长视频理解SOTA!蚂蚁&人大开源ViLAMP-7B,单卡可处理3小时视频

在视觉语言模型取得突破的当下,长视频理解挑战凸显。蚂蚁和人大团队提出视觉语言大模型ViLAMP,采用‘混合精度’策略,在多基准测试中超越现有方案,单卡可处理3小时视频,为实际应用带来可能。

机器之心
算法论文8

推翻「预测下一个token」范式!微信AI研究:把token压缩成连续向量更具性价比

微信AI和清华团队提出范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。

量子位
开源动态8

LLaVA-OneVision-1.5流程开源,8B模型预训练只需4天、1.6万美元

灵感实验室团队联合 LMMs - Lab 推出 LLaVA - OneVision - 1.5,流程开源。其 8B 模型预训练 4 天、成本 1.6 万美元,在多模态基准上性能优,还公开数据构建与训练策略等细节,复现简单。

机器之心
算法论文8

MeanFlow再下一城,北大提出机器人学习范式MP1,实现速度与成功率双SOTA

北大研究团队提出机器人学习范式MP1,将MeanFlow引入机器人学习,实现毫秒级推理速度。还引入分散损失提升少样本泛化能力,在仿真和真机测试中,实现速度与成功率双SOTA。

机器之心
开源动态8

Github 3.6k star,爆火开源「小红书 MCP」:一键登录、图文发布、搜索、评论搞定

`xiaohongshu-mcp`把浏览器手工步骤封装成可编排工具,以Go编写,能在无头/有界面模式间切换。它解决小红书运营多痛点,如登录不稳、发帖链路长等,覆盖登录、发帖等链路,适配多客户端,值得收藏上手。

小华同学ai
算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习范式

上海人工智能实验室提出策略判别学习(POLAR)范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能和泛化性优越。

量子位
推荐文章7

Agent狂欢下的冷思考:为什么说Data&AI数据基础设施,才是AI时代Infra范式

文章指出Agent成AI主流叙事,但企业部署后效果不佳,因未认识到Agent平台无法单独构成AI Infra。强调数据是AI Infra核心,提出Data&AI数据基础设施是范式,还分析赛道玩家并介绍科杰科技的实践。

机器之心
产品应用8

上海AI实验室发布 Intern Lumina U2:离散扩散建模,让模型既能“看懂”也能“生成”

上海人工智能实验室发布一代多模态统一模型 Intern Lumina U2,基于离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。

OpenMMLab
新闻资讯8

刚刚,球首个AI科学家登上Nature!包揽提出idea到写论文流程,已通过人类盲审

历经一年半研发,Sakana AI联合多高校打造的AI科学家系统登上Nature杂志。该系统能自主完成科研流程,代码和论文已开源。还介绍了自动审稿人、缩放定律,也指出其局限,引发伦理探讨。

AI寒武纪