新视角合成」共找到 3839 篇相关文章

新闻资讯8

Mamba一作预告架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
新闻资讯7

Ilya模型要来了?投资人爆料:今年最重要的发布!

a16z合伙人Martin Casado预告今年最重要的模型发布,线索指向Ilya Sutskever的模型。SSI成立两年低调发展,获巨额融资,7月与英伟达合作。持续学习是焦点,但相关能力信息有限。

机器之心
新闻资讯8

紫光集团三周年:智变跃升,交出硬核答卷

2025年7月11日紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求求变,深化合作。

芯师爷
推荐文章7

五源袁野:理解AI创业的五个视角 |5Y View

文章是五源合伙人袁野在五源2025创始人年会演讲,从五视角审视AI时代创业变化,如技术范式切换、供给边界演进等,为理解AI创业带来启发,强调创要敢于走路。

五源资本 5Y Capital
开源动态8

世界模型评测的最大盲区,被这个基准捅破了

过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出基准MemoBench,测试了主流模型,揭示其短板。

机器之心
算法论文8

吴恩达作:87%推理token用不着,丢掉反而快3倍

吴恩达作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供思路。

PaperAgent
算法论文8

微调已死?Google 和斯坦福论文指出AI 学习范式

Google的ReasoningBank和斯坦福的ACE两篇论文引发热议,二者都在解决让AI系统真正学会学习的问题。前者是经验管理系统,后者让输入上下文进化,都绕开微调探索AI持续学习与自我改进能力。

AI工程化
算法论文8

通义实验室最成果WebDancer:开启自主智能Deep Research的时代

通义实验室推出 WebDancer,解决自主信息检索智能体构建难题。它创合成训练数据,采用两阶段训练策略应对开放网络训练挑战,在多个基准测试中表现卓越,未来还将拓展能力。

机器之心
新闻资讯7

聊天框之外,AI 交互正在被哪些「界面」重写?

近期,「理想的 AI 交互形态」引发热议。目前流行的聊天对话框式 AI 交互有局限,一些产品开始在特定场景引入不同交互设计。文章还分析了多数 AI 产品界面停留在聊天框的原因及业界探索交互机会的情况。

机器之心
新闻资讯8

刚刚,OpenAI 发布 GPT‑5-Codex 模型,专为编程而生

OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台大升级,集成 GitHub,保障安全隐私,还公布了定价与可用性。

AGI Hunt