「视觉AI」共找到 10177 篇相关文章

新闻资讯7

拒绝招聘、产品粗糙,却成史上最快增长软件公司!4个00后“整顿”创业圈:大家都不信,才是我们的机会

Cursor是AI编程工具崛起代表,3个月发布、16个月超36万用户。其背后是4个00后创立的Anysphere公司。创始人Michael Truell分享创业经验,包括早期项目、转型细节,以及Cursor挑战GitHub Copilot的历程。

InfoQ
产品应用7

人形机器人终于学会洗碗了

Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。

量子位
新闻资讯8

市值超1500亿!江西宜春小镇走出“光芯片之王”

在全球AI算力竞赛白热化阶段,天孚通信创始人邹支农凝视新获专利的光接收器组件。他从江西宜春高安农村走出,攻克日本垄断的光通信技术,将公司市值推至1548亿,还在家乡投资兴业。

芯师爷
新闻资讯7

独家丨国内人形机器人首笔千台级商单出现

AI科技评论独家获悉,星尘智能与仙工智能达成人形机器人千台级订单战略合作,今年4季度起部分交付。这是国内人形机器人在工业领域最早一批千台级商单,双方采取‘供应链+产品+渠道’合作。

AI科技评论
新闻资讯8

谷歌Nature震撼发文,Gemini教练暴打专家!医学双料冠军,秒出睡眠报告

谷歌DeepMind把Gemini版大模型PH - LLM调教成「AI健康私教」,将可穿戴设备数据转化为睡眠健身建议,准确率超人类医生。它经两阶段训练,在多项测试中表现优异,或开启预防医学未来。

新智元
开源动态8

刚刚,大模型装上「鹰眼」!首创高刷视频理解,谷歌Gemini 2.5完败

面壁智能开源MiniCPM-V 4.5多模态端侧模型,8B参数越级反超72B巨无霸,在多领域达SOTA。它首创高刷视频理解,性能强、效率高、适合端侧部署,还实现多技术创新,是开源端侧多模态AI的革命。

新智元
推荐文章7

一文读懂:GPU到底是怎么工作的?

文章详细介绍GPU工作原理,对比其与CPU差异。指出GPU擅并行计算、能解决复杂问题,还分析FLOPS、延迟、内存等因素对性能的影响,最后讲了GPU通过多线程和超量订阅获高吞吐量。

芯师爷
开源动态8

轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源

上海人工智能实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。

OpenMMLab
算法论文8

首个3D动作游戏专用VLA模型,打黑神话&只狼超越人类玩家 | ICCV 2025

淘天集团未来生活实验室团队提出首个3D动作游戏专用VLA模型CombatVLA,已被ICCV 2025接收。它能处理视觉输入输出动作指令,在战斗理解准确率和执行速度上表现优异,还构建了评测基准等。

量子位
开源动态7

困在产业落地的数据流通,开源会成为“破局点”吗?

AI时代数据成生产要素,但可信流通困于产业落地。8月14日隐语开源社区三周年升级,扩容为‘隐语·数据可信流通技术社区’,覆盖多技术路线。其以开源降低应用门槛,或改写数据产业规则。

InfoQ