记忆评测基准」共找到 1796 篇相关文章

产品应用7

大神卡帕西又一构想落地!Claude Code + Obsidian 爆火:创建你的「第二大脑」

2026年4月,Andrej Karpathy提出LLM Wiki,将LLM使用范式推向「知识生产系统」。6月27日,RGK用Claude Code + Obsidian构建“第二大脑系统”,解决记忆、上下文、执行问题,还引入反馈机制、优化Token成本。

AI科技评论
产品应用8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5长文本推理专家,提供端到端长文本推理后训练“配方”,含数据合成管线、强化学习方法、智能体架构,在多基准测试成绩佳,代码已开源。

机器之心
开源动态8

Insanely Fast Whisper:开源社区让音频转录速度提升19倍

Insanely Fast Whisper工具将OpenAI Whisper转录速度提升19倍,采用Flash Attention 2技术,零质量损失。它集成多语言支持、说话人分离等实用功能,还支持跨平台,免费运行。最初是基准测试demo,值得音频处理用户关注。

AI工程化
产品应用8

Cursor 1.0 正式上线,写代码、审代码,一站式全能!多项功能体验升级!

Cursor 1.0正式发布,带来多项重磅升级。有自动代码审查与BugBot、后台智能体全面开放、Jupyter Notebook深度集成等功能,还引入记忆系统,升级一键集成与可视化体验。在对手被封杀背景下这次升级意义重大。

AI工程化
产品应用8

你奶奶也能看懂:DeepSeek-OCR的秘密。

本文介绍DeepSeek-OCR,它并非普通OCR工具,而是用“上下文光学压缩”将大量文本信息转为少量视觉Token。其架构含编码器和解码器,压缩效果惊人,重新定义AI“记忆”,或改变AI认知方式。

AI大模型应用实践
产品应用8

教育行业首个AI Agent落地!斑马口语「超人类外教」诞生

教育行业首个AI Agent落地,斑马口语推出「超人类外教」。它有「人」味,能灵活交流、共情,背靠猿力大模型,有记忆能力,性价比高,推动优质口语教育,或重塑教育行业。

量子位
开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
产品应用8

大涨240%,Doc-Researcher确立多模态文档深度研究新范式

在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。

PaperAgent
新闻资讯8

今年诺奖成果曾遭质疑无用,但华人团队用它研制了未来芯片的「钥匙」

2025年诺贝尔化学奖成果MOF曾因稳定性差、成本高,实际应用寥寥。如今,海外华人科研团队用其造出纳米级液体芯片,能执行逻辑运算,有记忆效应,成果发表在Science子刊。

新智元
算法论文8

你的 AI 助理一闭嘴就在「发呆」?上交大 ProAct:把 Agent 的空闲时间变成生产力

上海交通大学 APEX 实验室提出 ProAct 架构,能把对话空闲时间转化为主动准备机会。它有预测、筛选、交付三级流水线,经 ProActEval 评测效果佳,证明算力用对地方更重要,让 Agent 能提前为用户准备。

AI科技评论