「长上下文困境」共找到 1349 篇相关文章
LeCun发布最新世界模型:首次实现16秒连贯场景预测,具身智能掌握第一视角!还打脸用了VAE
LeCun团队推出PEVA模型,让具身智能体学会人类“预判能力”,首次实现16秒连贯场景预测。它结合结构化动作表示与条件扩散Transformer,用真实数据训练,解决长时序问题,还能筛选最优动作。
从文本到3D动画:AnimaX重新定义3D动作合成方式
北航与清华推出3D动画框架AnimaX,结合视频扩散模型运动先验与骨骼动画可控性,让任意骨架3D角色自然动起来。其核心方法灵活控制动作,虽有局限,但为3D动画创作打开新局面。
谷歌AlphaGenome横空出世!40亿年生命代码一键破解,或再夺诺奖
谷歌DeepMind发布AlphaGenome,可一次读取100万个DNA碱基,预测基因突变。它以长DNA序列为输入,预测数千种分子特性,克服了现有模型在序列长度和分辨率间的取舍问题,有望推动生物学研究和新疗法诞生。
哈工大发布动画多智能体,文本一键生成连贯动画
随着多模态模型兴起,AI生成叙事性视频成热点,但现有方法处理长视频有挑战。哈工大发布AniMaker框架,由多个智能体协作,实现文本到动画自动化转换,解决了视觉连贯和叙事一致等问题。
让chrome浏览器变成你的智能助手,浏览器转变为强大的 AI 控制自动化工具
Chrome MCP Server是基于chrome插件的模型上下文协议服务器,能让大模型或chatbot接管浏览器。它有chatbot/模型无关、用原本浏览器等特性,与同类项目比优势明显,还介绍了使用步骤、工具及示例。
一文读懂:国产AI芯片与英伟达的差距有多大?
文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。
图灵奖得主杨立昆现场追问:AI 还没越过这 3 道认知墙,谈什么通用智能?
图灵奖得主杨立昆指出AI未越过三道认知墙,即看不懂物理世界、无长时记忆、无推理结构,提出JEPA架构及AMI概念,还建议别卷模型,应卷架构,如探索具身智能等领域。
AI 创业怎么做?500+ 技术领导者给出了他们正在实践的答案| TGO 杭州十周年庆 & GTLC 杭州站
2026年6月27日,TGO杭州十周年庆·GTLC杭州站举办,以“新十年一起,做AI做的事”为主题。近二十位嘉宾从多方面分享,探讨AI创业、智能体架构等,还有创业者展示产品,活动丰富且聚焦学习。
AI软递归自我提升,Hassabis夜不能寐:人类已至奇点山脚
AI递归自改进和研究自动化正从概念走向现实,哈萨比斯称人类站在「奇点山脚」。Claude已独立编写超80%代码,Anthropic工程师效率大幅提升。但AI递归也带来安全风险,全球实验室陷入「囚徒困境」。