「AI基准测试」共找到 10907 篇相关文章

开源动态8

CVPR 2026 | AI寒武纪时刻?字节世界模型新作,仅靠视觉学习真实世界知识

豆包大模型团队与北京交通大学联合提出视觉世界模型 “VideoWorld 2”,无需依赖语言模型,仅靠视觉信息让机器掌握复杂能力。它能完成复杂手工任务,成功率远超主流模型,代码与模型已开源。

机器之心
8

光年之外居然做了能用Skills的AI浏览器:超实用实用案例+现成脚本

光年之外团队推出 Tabbit 浏览器,填补国内空白,有对话、妙招等 5 大核心功能。文章用5个案例展示其便捷性,如一键成稿、旅行规划等,还能解决收藏难题、增强网页功能,适配国内网站。

歸藏的AI工具箱
算法论文8

英伟达护城河被AI攻破,字节清华CUDA Agent,让人人能搓CUDA内核

近日,字节跳动Seed团队和清华AIR的CUDA Agent引发轰动。它能编写经优化的CUDA内核,性能超torch.compile等。研究发布CUDA - Agent - Ops - 6K数据集,介绍系统管线设计、训练流程,实验结果佳,但有未对比复杂编译器等局限。

机器之心
算法论文8

测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因

Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证表明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。

PaperAgent
新闻资讯7

算力越高收入越多!OpenAI率先验证AI商业Scaling Law:最新收入200亿美元

OpenAI首席财务官公告显示,其年化经常性收入从20亿美元涨至200亿美元,2023 - 2025年算力增9.5倍、收入增10倍。挣得多也烧得多,其还投建数据中心。首款硬件或2026下半年推出。

量子位
算法论文8

Science重磅!新药发现提速千万倍,清华用AI把药物筛选变成向量检索

清华大学团队在《科学》发表DrugCLIP研究,将对比学习引入药物发现,把分子对接转为向量检索,使虚拟筛选速度提升千万倍,还构建全球首个全人类蛋白质组药物筛选数据库。

AIGC开放社区
新闻资讯7

Anthropic深夜再出杀招!编码AI一键清空桌面,白领末日来临?

Anthropic推出办公神器Cowork,复用Claude Code底层逻辑,可完成日常任务,如整理桌面、处理文件等。它上手门槛低,主动性强,还能持续升级。不过其诞生或冲击初创公司,也需留意使用权限和安全问题。

新智元
新闻资讯7

刚刚,苹果官宣iphone搭载最强AI,每年给Google 10亿,不愿在信ChatGPT。

早上苹果与Google官宣的新闻刷屏,下一代苹果基础模型将基于Gemini构建。苹果因自研来不及且人才流失,选择花10亿买Google模型。还分析了未选OpenAI的原因,以及隐私方面的问题。

探索AGI
算法论文8

让 AI 自己打怪升级,Meta用Self-play RL把Coding推向超级智能

Meta FAIR、Meta TBD Lab等朝着“超级智能软件工程Agent”迈出第一步。SSR让大模型零人类标注,靠自生成Bug和自修复稳定碾压人类数据基线,新旧范式对比优势明显,还介绍方法、实验结果与理论洞察。

PaperAgent
新闻资讯8

AI破解500年《纽伦堡编年史》天书!仅用1小时,隐藏惊天真相被揭开

500年前《纽伦堡编年史》中的手写注释难倒人类学者,Gemini 3.0 Pro仅用1小时就给出解读,识别出注释与圣经年代学体系计算有关。它攻克视觉识别、解读缩写、还原历法转换表三大难题,展现惊人能力。

新智元