视觉记忆模型」共找到 8190 篇相关文章

新闻资讯7

刚刚!Ilya首个模型曝光了

前OpenAI首席科学家Ilya离开两年后,X网友爆料其创办的SSI正探索基于TTT的小型推理引擎,当前版本或8月向少数用户开放。该爆料与Ilya观点及英伟达合作等线索相符,但也面临安全难题。

量子位
算法论文8

Meta 重磅提出「神经计算机」:模型即电脑

Meta AI和KAUST提出「神经计算机」概念,目标是让神经网络承担计算、内存、输入输出。论文给出完整框架并做原型验证,虽当前原型距目标差距大,但提出问题和定义框架意义重大。

AGI Hunt
算法论文8

AdaGen: 让图像生成模型学会自适应策略

当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。

机器之心
推荐文章7

大概念模型:AI 推理的新范式

大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。

InfoQ
产品应用7

基于 Gemini 模型做 SEO Agent 简单实战

作者参加 Google I/O 大会后,受 James 用 AI 做 SEO 启发,尝试基于 Google 的 Gemini 2.5 Pro 模型制作 SEO 智能体。介绍数据获取方法,构建 3 个 Agent 进行分析、提建议和输出报告,Gemini 负责理解决策,适合出海企业。

特工宇宙
算法论文8

MoCa:首个大规模双向多模态表征模型

为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它分两阶段,实验效果好,未来可拓展模态、提升多语言适应等。

PaperAgent
新闻资讯7

DeepSeek新模型意外曝光:AI Agent才是未来~

据彭博社消息,中国AI新星DeepSeek计划年底发布对标OpenAI的AI Agent,能自主执行多步任务、自我学习进化。国内Kimi、Qwen也有相关动作,还分享了72多种高效AI工具。

PaperAgent
开源动态7

any-llm:又一个统一模型服务接口的Python代理库

Mozilla AI开发的开源项目any-llm,解决多LLM提供商接口统一问题,能让开发者用一个接口调用不同大语言模型。它吸取此前产品长处,有统一接口等优势,使用和安装简单。

AI工程化
新闻资讯7

Claude最新模型Mythos意外泄露,性能远超Opus

Anthropic内容管理系统配置失误,近3000个未发布资产泄露,Claude最新模型Mythos提前公开。它在软件编码、学术推理和网络安全等测试中远超Opus,网络安全能力尤其危险。2026年初Anthropic产品密集发布。

开源AI项目落地
产品应用8

谷歌新模型登顶Nature,人类基因密码被解码

谷歌推出全新AI工具AlphaGenome,能精准预测人类DNA序列变异对调控基因生物过程的影响。它满足多项条件,在26个变异效应benchmark中25个达SOTA,还通过多个案例和实验验证了其性能。

PaperAgent