视觉领域」共找到 2295 篇相关文章

开源动态8

几张GPU干翻超算!耶鲁AI颠覆化学合成,实验成功率71%

近日,耶鲁大学李昊特团队开发 AI 系统 MOSAIC,将化学合成知识分 2498 个领域训练专家模型。测试中对超 35 种新化合物合成成功率达 71%,还完成难反应与新反应,相关论文发表于《自然》。

DeepTech深科技
产品应用7

AI Agent做PPT卷疯了,最强选手被挖掘出来了

2025年是AI Agent元年,做PPT成成果显著领域。Agent能自主完成PPT全流程,解决此前导出编辑难题。文章对比GenSpark、天工Agent等产品在不同场景做PPT的表现,为用户选择提供参考。

鲸选AI
算法论文8

ICML 2025 | 清华、上海AI Lab提出专家级医学基准MedXpertQA,看o3、R1哪家强

本文由清华和上海AI Lab学者撰写,提出专家级医学基准MedXpertQA。现有医学基准难度和临床相关性不足,而MedXpertQA极具挑战、临床相关性高,构建严格,评测显示前沿模型在医学领域提升空间大。

机器之心
新闻资讯8

谷歌AlphaEvolve引发OpenAI关注:AI原创算法,正挑战人类专家界限

谷歌DeepMind推出的AlphaEvolve系统,结合Gemini模型与进化算法,能自主探索、生成并迭代优化算法代码。它优化经典算法,在多领域取得突破,其原创能力引业界关注,OpenAI研究员对此表示震撼。

AI寒武纪
新闻资讯8

Andy Pavlo:2025年数据库年度回顾

Andy Pavlo回顾2025年数据库领域,提及PostgreSQL发展、MCP支持情况、MongoDB起诉案、文件格式竞争等。还介绍收购、合并、融资等动态,以及数据库元老拉里·埃里森的成就,最后给出建议并提及新创业公司。

InfoQ
算法论文8

让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了

近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。

机器之心
新闻资讯7

马斯克刚关注了这份AI报告

受谷歌DeepMind委托,Epoch发布报告剖析2030年AI的发展。指出训练成本或超千亿美元,公开文本数据2027年耗尽等,马斯克也关注此报告。还从多方面论证发展趋势可延续,且AI将加速多领域科研。

量子位
新闻资讯7

深空探测美学色彩首个研发成果——“月壤色”主题发布活动在首钢园成功举办

7月5日,深空探测美学色彩“月壤色”主题发布仪式暨科普活动在首钢园举办。该活动由嫦娥奔月航天科技主办,众多专家出席。“月壤色”是基于科研成果的美学成果,可用于多领域,活动还展示相关成果进行科普。

首钢园
推荐文章8

解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南

给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。

AIGC开放社区
新闻资讯7

AI 开发工具的隐形战场:新一轮 IDE 之争打响!

在AI开发工具领域,VSCode成主战场,但背后有技术和策略拉扯。开发者面临战略选择,VSCode有诸多限制,OpenVSX虽提供替代方案但插件不全,Cursor崛起引发微软动作,未来走向待察。

AI科技大本营