云的形状」共找到 10844 篇相关文章

算法论文8

突破一亿Token极限:EverMind提出MSA架构,实现大模型高效端到端长时记忆

机器之心发布文章介绍,大模型长期记忆能力受限于上下文长度。《MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens》提出MSA架构,突破扩展性、精度和效率不可能三角,实现100M长度大模型长时记忆框架。

机器之心
新闻资讯8

最新!Sam Altman:GPT-5几乎所有方面都比我们聪明,准备好直面超级智能

OpenAI奥特曼在播客中透露GPT - 5已在内部测试,其能力让他有无力感。他认为GPT - 5虽更聪明,但不意味人类价值终结,还提出环球基本财富构想,也坦言对AI影响担忧。

AI寒武纪
算法论文9

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

上海交大与上海AI实验室团队研究,针对当前具身智能依赖理想化环境与指令假设痛点,提出REAL框架,统一主动探索、意图消歧与执行为闭环,支持零样本迁移至真机,已开源代码并被ECCV 2026接收。

机器之心
产品应用7

Fable 5.1 官方提示词指南

Anthropic 发布 Fable 5.1 后,同步发布《Prompting Claude Fable 5.1》提示词指南,列出 15 个 5.1 跟 Fable 5 在行为上差异,并附修正提示词。还介绍了 Fable 5 提示词变化,以及 Fable 5.1 新特性和应对建议。

AGI Hunt
新闻资讯7

田渊栋被裁后新offer排到法国!原来Llama 4.5训完后被卸磨杀驴了

Meta此次裁员引发诸多争议,工作超十年田渊栋整组被裁。有说法称是因没做出基于Llama 3推理模型,但田渊栋否认。Llama 4.5训练好后团队被裁,且后续还将裁风控部门。不过田渊栋获多家公司青睐。

量子位
算法论文8

Code2Video:代码驱动、智能体协同、精准可控教学视频生成

新加坡国立大学 ShowLab 团队提出 Code2Video,一种基于代码驱动视频生成新范式。它以可执行代码为媒介,结合三智能体协同框架,解决了现有文生视频方法在教育场景不足,在美学和教学效果指标上有明显提升。

机器之心
算法论文8

AI已迷失方向?强化学习教父Sutton最新发布OaK架构,挑战当前AI范式,提出超级智能新构想

强化学习教父理查德·萨顿认为人工智能发展已迷失方向,提出OaK架构回应探寻真正智能需求。该架构是基于模型强化学习架构,具备组件持续学习等特点,为通用人工智能指明路径,但面临持续学习和特征生成挑战。

AI科技大本营
产品应用7

AI 播客原理解析

作者分享用豆包AI播客将英文长文转成高质量播客体验,解析AI把文章变真人对话式语音播客原理,涉及提示词工程和文字转语音技术,还介绍提示词写作与优化过程及长文处理方法。

宝玉AI
产品应用9

乐享以太大模型,让中国具身智能坐上定义席

本文围绕乐享科技推出以太大模型展开,指出当前具身智能主流VLA、WAM路线均存在固有缺陷,以太大模型改用能量驱动求解范式,经开放烧烤直播测试验证其能力,开辟Physical AI新路径,推动中国具身智能突围。

AI科技评论
开源动态7

24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进

2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss技术演进,拆解关键创新点,对比了与Qwen3差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。

PaperAgent