新全栈」共找到 5133 篇相关文章

新闻资讯8

Mamba一作预告架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
新闻资讯7

Ilya模型要来了?投资人爆料:今年最重要的发布!

a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。

机器之心
新闻资讯8

紫光集团三周年:智变跃升,交出硬核答卷

2025年7月11日紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求求变,深化合作。

芯师爷
开源动态8

世界模型评测的最大盲区,被这个基准捅破了

过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出基准MemoBench,测试了主流模型,揭示其短板。

机器之心
算法论文8

吴恩达作:87%推理token用不着,丢掉反而快3倍

吴恩达作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供思路。

PaperAgent
新闻资讯7

这家国内公司,在给具身智能技术做「通解」

具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术多种落地形式,展示自研通用机器人「眼脑手」技术产品,推动机器人各行业落地。

机器之心
算法论文8

RL成本降幅超90%!Meta提出Agent训练范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟路径。

深度学习自然语言处理
产品应用8

从Vibe Coding到Agentic Engineering:重构后台开发流程

文章介绍从 Vibe Coding 到 Agentic Engineering 的转变,以真实需求为例,展示后台开发流程,涵盖需求获取到合入发布各阶段,介绍各阶段工具及操作,凸显 Agentic Engineering 优势,强调人编排、AI 执行的核心理念。

腾讯技术工程
7

老黄怒怼玩家根本不懂AI!英伟达AI功能遭网抵制,游戏圈炸锅了

英伟达在GTC 2026发布DLSS 5,本应是“性能革命”,却遭游戏圈抵制。它用生成式AI“注入”光影和材质,从“帮放大画面”变为“帮重绘画面”,玩家不满AI网红脸,老黄称是“GPT时刻”。

量子位
算法论文8

微调已死?Google 和斯坦福论文指出AI 学习范式

Google的ReasoningBank和斯坦福的ACE两篇论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。

AI工程化