隐式路线」共找到 373 篇相关文章

推荐文章8

AI-Native 的 Infra 演化路线:L0 到 L5

文章来自 Agent Infra 创业者 Hang Huang,以其产品开发实践经验,分享 Agent Infra 机会。指出 AI 编程生产力跃迁,从写代码到掌控软件全生命周期是趋势,还提出 L0 - L5 模型描述 AI-Native Infra 演化路径。

海外独角兽
开源动态8

AGI 新技术路线:下一代稀疏注意力机制 Monte Carlo Attention 开源

超对称技术公司在新版基座模型 BigBang - Proton 中使用的 Monte Carlo 注意力开源。它基于二进制块编码技术,用块间代表交流机制实现线性复杂度,兼具多种注意力机制优点,可满足宇宙尺度建模的上下文长度需求。

AI科技大本营
开源动态8

AGI新技术路线:下一代稀疏注意力机制Monte Carlo Attention开源

超对称技术公司开源了 Monte Carlo 注意力机制,用于新版基座模型 BigBang - Proton。它在二进制块编码技术上,用块间代表交流机制实现线性复杂度,解决了传统方法的缺点,可实现理论上无限的上下文长度,对现有预训练技术和硬件设计影响深远。

InfoQ
推荐文章8

刚刚,商汤内部两万字复盘曝光:多模态通往AGI核心路线首次公开

商汤科技联合创始人林达华撰写万字长文,剖析将「多模态通用智能」视为技术战略核心引擎的原因,探索组织及战略层面的思考。文章回顾商汤多模态之路,探讨多模态通向AGI的原因、构建路径等关键问题。

新智元
算法论文7

CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?

CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。

机器之心
新闻资讯8

Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI

OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。

新智元
新闻资讯8

奥特曼承认OpenAI路线走偏了,以及“写代码将变得不再重要”

奥特曼在直播中给出诸多实诚结论,如未来工程师人数或大幅增加,写代码时间将减少,OpenAI搞砸ChatGPT5系列模型,后续会回归通用模型,还探讨了AI对教育、经济、安全等方面的影响。

量子位
算法论文8

感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。

量子位
新闻资讯8

神秘具身团队又放出一连串很炸的Demo视频…自进化模型,技术路线曝光

神秘具身团队放出一连串Demo视频,其内部代号“MVP”的模型让机器人似人般思考决策。视频展示机器人在不同场景下的表现,如躲避推搡、做家务、机器人协作、高效收纳等,体现对物理规则和人类习惯的理解与自进化能力。

量子位
算法论文8

冷门新语言AI写不动?IEEE论文:从零到及格线,MoonBit给出完整训练路线

IEEE论文聚焦新语言MoonBit和Gleam,探讨大模型代码生成能力。研究发现大模型零样本生成新语言代码能力差,few - shot和RAG有提升但有限,继续预训练及指令迁移可显著提高模型表现。

量子位