「视觉 AI」共找到 10150 篇相关文章

产品应用7

企业出海,被中国信通院和腾讯重新定义了一次

中国企业出海面临信息分散、专业支撑不足、属地化服务难等问题。7月17日,中国信通院与腾讯在2026世界人工智能大会共赢金砖论坛上推出AI航海家+,将七国生意经装进AI对话框,有22位懂当地规则的专家,能替企业做判断。

量子位
推荐文章7

龙虾之后,我看到了 OPC 的新机会:FDE

3月龙虾爆火催生上门安装生意,大厂纷纷下场。背后是FDE商业模式,即前沿部署工程师模式。该模式在AI时代火起来,因AI Agent需求难定义,且做FDE门槛降低。FDE能弥合产品与需求差距,对OPC创业有借鉴意义。

特工宇宙
开源动态8

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

近年来,Coding Agent 发展迅速,「AI 软件工程师」渐成现实。但目前缺少系统评测其从设计稿开发产品能力的公开 Benchmark。为此,多校研究团队推出 VISTA,可多维度评测 Coding Agent 开发能力,且持续更新。

机器之心
新闻资讯8

同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生全模态文心5.0

2025年,OpenAI凌晨更新GPT - 5系列,百度在世界大会发布文心5.0。它采用原生全模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。

机器之心
算法论文8

ICCV 2025 | FDAM:告别模糊视界,源自电路理论的即插即用方法让视觉Transformer重获高清细节

针对视觉 Transformer(ViT)‘低通滤波’特性致细节丢失问题,北京理工大学等团队提出即插即用的 FDAM 模块。它受电路理论启发,能提升模型在分割、检测等任务性能,取得 SOTA 效果,有巨大应用潜力。

机器之心
新闻资讯7

NeurIPS近3万投稿爆仓,强拒400篇论文!博士疯狂内卷,AI顶会噩梦来袭

AI顶会现「爆仓危机」,NeurIPS 2025双会场仍难容纳近3万投稿,约400篇已录用论文被拒收。AAAI 2026投稿也破纪录,近7成来自中国。各顶会录用率降、审稿人缺、质量下滑。

新智元
推荐文章7

马斯克的好兄弟,卡帕西又双叒出新指南!GPT-5 Pro是AI编程最后防线

在「代码后稀缺时代」,Karpathy分享AI辅助编程体会。他认为不同工具各有优劣,Cursor适合日常开发,Claude Code与Codex能完成大块功能但缺「品味」,GPT - 5 Pro是攻克顽固bug的最后防线。

新智元
算法论文8

ICCV 2025|UV-CoT:无监督视觉推理新突破,偏好优化重塑图像级思维链

随着文本领域思维链推理机制成功应用,研究者将其引入视觉理解任务。现有模型有局限,本文提出UV - CoT新框架,设计无监督数据生成与偏好优化机制,提升模型能力,摆脱对人工标注依赖。

机器之心
7

BJIFF·电影+|第十六届北京国际电影节AIGC电影单元征片公告

第十六届北京国际电影节AIGC电影单元开启征片,该单元已成长为全球关注的AI电影创作新阵地。介绍了组织架构、征集时间与范围、作品要求、荣誉设置等,还设有活动福利,致力于打造全球AI影视创新平台。

AIGC开放社区
新闻资讯7

一夜变天!谷歌一刀砍向两巨头:奥特曼急了,黄仁勋慌了

最近谷歌重回AI舞台中央,左手TPU拆解英伟达芯片暴利,右手Gemini 3围剿OpenAI流量帝国。谷歌高管称「Gemini 3开启智能新纪元」,在多项基准测试中超越GPT - 5。Nvidia和OpenAI面临严峻挑战,AI三国混战已开始。

新智元