视觉能力评估」共找到 4093 篇相关文章

推荐文章7

最新 AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?

国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3时刻”,但需数千至上万年“模型处理任务所用时间”训练。还提出“复制训练”新范式,能磨炼模型能力,补足短板。

AI科技评论
开源动态8

MemOS:一种用于 AI 应用的记忆操作系统

大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。

PaperAgent
新闻资讯7

Anthropic 最强模型 Mythos 发布了,但你暂时用不上

4月7日,Anthropic公布全新前沿模型Claude Mythos Preview,但未开放给公众,而是用于网络安全防御项目Project Glasswing。该模型安全能力强大,能发现大量零日漏洞并编写攻击代码,普通用户短期内难用上。

宝玉AI
产品应用7

一键搞定百万行Excel和PPT排版!这家杭州电力AI初创要给打工人减负

AI生产力革命被困云端,本地智能体工作台XMO - AgentBox应运而生。它由杭州曦谋决策打造,集成DeepSeek模型,能处理复杂场景,有平台化能力、核心价值,适合专业人士,现可免费下载桌面版。

量子位
产品应用8

教育行业首个AI Agent落地!斑马口语「超人类外教」诞生

教育行业首个AI Agent落地,斑马口语推出「超人类外教」。它有「人」味,能灵活交流、共情,背靠猿力大模型,有记忆能力,性价比高,推动优质口语教育,或重塑教育行业。

量子位
开源动态8

这款OCR神器绝了,PDF、表格、手写体通吃,20+文档支持,9.4K Star!

开源君在Github发现开源OCR工具Zerox,由Omni - AI团队开发,利用AI视觉模型“阅读”文档,将多种格式文档转Markdown。它功能强大,处理复杂文档优势明显,在Github获9.4K Star。

开源先锋
开源动态7

MIT团队完成AI控制人类行为实验项目

MIT团队的Human Operator项目是实时人体增强工具,也是MIT Hard Mode 2026获奖项目。它通过视觉 - 语言模型结合电刺激肌肉实现人体运动控制,介绍了技术栈、环境要求、软硬件准备、安装步骤等。

GitHubStore
推荐文章7

鹅厂员工怎么看Agent自动持续进化?

落地一个Agent容易,但让其自动持续优化很难。文章分享了9位鹅厂同事对“Agent如何自动持续进化”的看法,如建立评估体系、记录真实任务反馈、结合强化学习等。

腾讯技术工程
产品应用8

TRAE SOLO 模式中国版惊艳上线,重新定义 AI 编程

字节 TRAE 推出 SOLO 模式解决复杂编程任务难题,11 月 25 日国内版上线且免费。它体验增强,集成 SOLO Coder,有执行前方案评审等四个关键能力,带来新协作模式,提升编程效率。

特工宇宙
算法论文8

LeCun力荐的JEPA杀入LLM,用CV的思路训练LLM,性能鲁棒性双丰收

LeCun团队提出LLM - JEPA,将JEPA自监督学习架构从视觉扩展到LLM。它能提升性能和鲁棒性,在多模型和数据集验证有效,但有训练开销大、泛化性不足等局限。

机器之心