图像检索」共找到 710 篇相关文章

7

前两天刚被群嘲,ChatGPT转头就解决了一个数学难题

前些天,OpenAI研究员宣称GPT - 5‘发现’数学难题解法被指只是检索文献引群嘲。但加州大学洛杉矶分校教授用ChatGPT解决凸优化未决问题,还有教授用其发现命题反例,甚至要将其列为论文一作,AI正成研究伙伴。

机器之心
推荐文章7

从大厂设计师到超级一人公司:6000字回顾我和AI的2025

作者回顾2025年,身份从大厂设计师变为自由职业者,用AI加持做超级一人公司。自媒体上各平台粉丝量增长,开始做视频;社群活动帮创业者和会员;创作涵盖Vibe Coding、Agent、图像视频等;还介绍合作产品,展望2026年AI趋势。

歸藏的AI工具箱
新闻资讯7

给 Agent 接搜索功能,有哪些「坑」需要特别注意?

搜索是AI产品标配,但给AI接搜索不易,给人用和给AI用的搜索差异大。信息检索质量影响Agent推理与任务完成度。邀请小宿科技相关人员聊给Agent接入搜索能力,10月30日20点线上闭门活动可扫码报名。

Founder Park
算法论文7

3D-R1重塑三维视觉语言推理!让三维交互更智能

近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。

带你学AI
开源动态8

分割一切并不够,还要3D重建一切,SAM 3D来了

深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。

机器之心
算法论文8

3D VLA新范式!CVPR冠军方案BridgeVLA,真机性能提升32%

中科院自动化所提出BridgeVLA模型,将3D输入投影为2D图像并利用2D热图进行动作预测。它训练分两阶段,在多仿真基准和真机实验表现卓越,仅3条轨迹基础任务成功率达96.8%,真机性能提升32%。

新智元
算法论文8

传统RAG只会翻书不会用?RAG+让Reasoning能力上一个新高度!

现有检索增强生成(RAG)技术在需复杂推理领域表现不佳,像只给菜谱不给实操演示。RAG+开创性新增“应用案例库”,与知识库构成双料库,在数学、法律、医疗场景测试中全面碾压传统方案,团队还透露了未来方向。

深度学习自然语言处理
推荐文章7

AI 取代不了放射科医生

人们曾认为AI图像识别技术会让放射科医生被淘汰,如杰弗里·辛顿预言应停止培训该类医生。但过去十年,放射科医生需求反而增加。文章以其为例,分析AI难取代的原因,如基准测试局限、医生工作复杂、AI落地困难等。

宝玉AI
产品应用8

AI真有希望考清北了!豆包1.6多模态推理发威,闯关数理化带图大题

火山引擎原动力大会发布豆包大模型1.6,它是国内首款多模态SOTA模型,支持256k上下文长度。实测中它解答高考数理化带图大题表现出色,还具备图像识别、视频理解、GUI操作等能力。此外,火山引擎还推出系列工具和平台助力企业。

新智元
8

对话百度文库:不做大模型能直接做的事,能力积累换来竞争壁垒|AI产品Time

百度文库从文档检索平台转型为一站式AI内容获取和创作平台,付费用户超4000万,AI MAU近亿,智能PPT访问量全球第一。访谈中,负责人分享产品理念、优势及运营经验,如不走大模型能直接做的事,从用户需求出发开发功能等。

量子位
上一页71 / 71下一页