长上下文建模」共找到 1389 篇相关文章

开源动态7

实测Perplexity Pro平替模型,免费开源仅4B

一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。

量子位
算法论文7

Gemini 2.5 Pro 是怎么炼成的?-- gemini 2.5 技术报告阅读笔记与思考

文章是 Gemini 2.5 技术报告阅读笔记。介绍其成功点有多模态、LongContext、思考能力;还阐述模型结构、训练和数据情况,以及代码、事实性、上下文等特定能力的提升,最后提到基于其构建的智能体。

chaofa用代码打点酱油
新闻资讯7

贴脸对打Opus 4.5!最新Codex自己写自己,网友实测“放手”8小时不崩

Claude Opus 4.6发布不到半小时,OpenAI就上线GPT - 5.3 - Codex,这是其最强的Agent化编程模型。它多项跑分超Claude Opus 4.6,网友实测链路稳定性好,虽慢但稳。OpenAI总裁称Agent正重构软件开发。

InfoQ
产品应用7

Sora 2 App 上手体验攻略,附Sora AI视频

本文是Sora 2 App上手体验攻略。Sora 2 PC版能依提示词生成精美电影感视频,还可创建虚拟形象;App交互似抖音,能录制上传自身形象生成视频。其生成视频镜头自然,有“AI导演感”,但目前时较短。

AI Reading Hub
产品应用8

Moxt 实测:把你的组织,折叠进一堆文件夹

作者实测 Moxt 后发现,它能解决 AI 产品上下文散且脏的问题,提供工作空间,让 AI 在原生格式工作;用户可创建专属 AI,还能精简 Context。此外,它支持技能组合、定时任务等,输出拓展到视觉形态。

歸藏的AI工具箱
开源动态8

蚂蚁发布全球首个视频-动作世界模型,开源即刷新世界纪录

从Sora惊艳亮相到谷歌开放Genie 3线上体验,世界模型从概念走向交互世界。蚂蚁旗下蚂蚁灵波开源全球首个视频 - 动作世界模型LingBot - VA,可驱动机器人完成复杂操作,解决时漂移等问题,还提出工程化解法。

MacTalk
算法论文7

「Next-Token」范式改变!刚刚,强化学习预训练来了

微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。

机器之心
开源动态7

Agent = LLM + Memory + Planning + Tool Use

文章指出LLM设计无状态,产生幻觉,超上下文窗口也无法解决记忆问题。介绍人类记忆的三个系统,阐述Agent记忆四层演化及每层问题,推荐开源项目Cognee将向量、图、关系型结合互补。

CourseAI
产品应用8

MV导演诞生!上海巨人网络用让AI听懂音乐并掌镜拍摄MV

上海巨人网络AI实验室提出YingVideo - MV框架,结合音乐语义分析、镜头规划与视频生成模型,解决传统音频驱动视频生成难题。它分两步生成视频,以MV导演模块统筹,还解决视频连贯性等问题,性能优于同类模型。

AIGC开放社区
产品应用8

刚刚,AI音乐被重新定义!昆仑天工甩出新王炸,拿下全球第一

如今AI神曲传播快,AI音乐或帮助作品出圈。1月28日昆仑天工发布音乐大模型Mureka V8,新模型降低创作门槛,提出AI音乐成新音乐品类概念。实测其作品出色,技术上靠MusiCoT和人声建模加持。

机器之心