语言世界模型」共找到 8175 篇相关文章

推荐文章7

AI 创业最大的问题,不是 FOMO,而是没想清楚

Anthropic 对齐研究负责人 Jordan Fisher 在 YC 分享中提出诸多 AI 创业思考,如按两年后世界规划产品、软件是否商品化、信任问题及护城河等,虽当下多无答案,但思考很重要。

Founder Park
开源动态8

彻底戳穿AI「失忆症」!超越OpenAI全局记忆,中国队开源LLM记忆操作系统

语言模型有「记忆」缺失问题,国内顶尖团队打造出操作系统级AI记忆框架MemOS并开源且可商用。它将「记忆」升为「一级资源」,用MemCube封装记忆,评测显示性能优于OpenAI全局记忆方案。

新智元
产品应用8

别再手搓测试数据了!AE测试数据智造系统揭秘

本文介绍基于大语言模型的AE测试数据智造Agent,解决AliExpress跨境电商测试数据构造难题。它结合大模型与原子工具库,实现自然语言驱动的全链路测试数据生成,提升测试效率与智能化水平。

阿里云开发者
新闻资讯7

华为看好的具身公司又融 10 亿!极佳视界宣布完成 Pre-B 轮融资,老股东超额加持

近日,极佳视界宣布完成近 10 亿元 Pre - B 轮融资,资方阵容豪华,老股东超额加持。此前 2025 年已完成多轮融资,华为还与其深度合作。该公司专注具身基模和通用机器人,产品有世界模型平台等。

AI前线
新闻资讯8

独家对话大晓机器人陶大程:具身机器人大脑,不必装下整个世界|甲子光年

甲子光年独家对话大晓机器人陶大程,探讨具身机器人大脑。陶大程提出控制充分状态,大晓用Kairos模型回应世界模型问题,强调行动后果建模,还谈了数据处理、技术风险及应用场景等。

甲子光年
算法论文7

The Batch: 939 |在推理阶段学习长上下文

大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。

DeeplearningAI
算法论文7

一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"

研究者发现,将 Opus 等强模型返回的加密推理块交给同家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。

深度学习自然语言处理
新闻资讯7

Claude强到不敢发的Mythos,被质疑用了字节Seed技术

Claude最强“神话”模型Mythos引发猜测,或用了字节Seed技术。社区热议其是否采用循环语言模型架构,关键线索来自Anthropic测试数据,在图搜索测试中Mythos优势明显,还有其他线索指向循环架构。

量子位
算法论文8

性能提升11.74%!腾讯优图提出激励推理,专攻复杂指令

现有大语言模型处理复杂指令能力不足,腾讯优图研究团队提出激励推理方法。该方法能提升LLM处理复杂指令表现,在1.5B参数LLM上性能提升11.74%,媲美8B参数模型

量子位
新闻资讯7

OpenAI偷袭,谷歌掀桌!2026开年第一场AI大战太精彩

OpenAI悄悄上线ChatGPT Translate挑战谷歌翻译,该工具支持超50种语言,有翻译后「二次加工」能力,但功能尚不完善。谷歌则高调开源TranslateGemma模型,支持55种语言,效率惊人,12B参数超越27B基线。

新智元