新全栈」共找到 5133 篇相关文章

开源动态8

用短视频成本生成长视频,字节Seed注意力机制让计算量降低85%

字节Seed与斯坦福等机构推出模型,其注意力机制MoC能让长视频生成计算量降低85%,质量不减且保持连贯性。团队将视频生成定义为上下文检索任务,提出MoC机制并阐述实现方法。

量子位
新闻资讯8

深度讨论 Gemini 3 :Google 王者回归,LLM 一轮排位赛猜想|Best Ideas

近期,OpenAI、Google、Anthropic 先后发布模型,引发大模型竞赛。本文聚焦 Google 发布的 Gemini 3,从算力、数据、架构等维度剖析其强大原因,探讨大模型竞争格局,还涉及多模态、硬件、商业化及产品形态等方面。

海外独角兽
算法论文8

冷门语言AI写不动?IEEE论文:从零到及格线,MoonBit给出完整训练路线

IEEE论文聚焦语言MoonBit和Gleam,探讨大模型代码生成能力。研究发现大模型零样本生成语言代码能力差,few - shot和RAG有提升但有限,继续预训练及指令迁移可显著提高模型表现。

量子位
新闻资讯7

机器人程自主收拾客厅!390亿美元估值机器人端到端技能,英伟达持续加注

估值390亿美元、英伟达持续看好的Figure机器人有进展,能完自主、端到端流程整理客厅。背后是其自主研发的具身大脑Helix 02系统,仅补充数据就能掌握任务。

量子位
推荐文章8

英伟达GPU系列硬核科普手册:一文读懂NVIDIA芯片的定位、规格与应用场景

这是英伟达GPU系列硬核科普手册,覆盖消费级、工作站、推理卡、训练卡及中国特供版五大产品线,讲清区别与用法,还介绍架构演进、命名规则等,助读者秒变选型高手。

腾讯技术工程
开源动态8

小钢炮开源,一张3090两小时「从零训练0.1B模态模型」,模型训练彻底平民化

MiniMind - O是开源超轻量级端到端模态大模型,采用双轨架构。仅需一张RTX 3090,2小时就能从零训练链路。有两套训练数据,具备零样本声音克隆等特点,实现大模型训练平民化。

开源AI项目落地
开源动态8

小红书发布FireRedChat:首个可私有化部署的双工大模型语音交互系统

小红书智创音频团队推出业内首个支持私有化部署的双工大模型语音交互系统FireRedChat,可将半双工链路升级为双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型周期的面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有生命周期梳理等三大贡献。

机器之心
开源动态8

AI 真能看懂物理世界吗?FysicsWorld:填补模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为模态智能发展提供指引。

机器之心
推荐文章8

AI Coding 之后,如何让 Agent 进入企业研发链路?得物推荐的 Harness 实践

得物资深技术专家白忠魏在AICon大会分享实践。团队目标是将AI Coding扩展为链路方法,介绍了PDCA循环、链路前提、七阶段护栏等探索,还提及用知识体系和混合Agent架构解决问题,已有阶段性成果。

InfoQ