「视觉AI」共找到 10150 篇相关文章

产品应用7

不只OpenClaw,这个app让你同时拥有龙虾和云手机

作者在OpenClaw主题直播中翻车,后发现RedClaw app可免配置免费体验OpenClaw。它提供云手机和AI,能突破移动端数据孤岛。作者测了3个场景,虽有不足,但认为方向正确,值得关注。

花叔
产品应用8

从GLM-4.5到GLM-5,我见证了一个模型从码农晋升为架构师

智谱以匿名方式将GLM - 5放到OpenRouter公测,其表现亮眼。在AI编程从Vibe Coding转向Agentic Engineering的背景下,GLM - 5参数规模提升,成绩优异,实测决策有架构师思路,持久力强,不再只是‘平替’。

花叔
新闻资讯8

摩尔线程的野心,不藏了

上市15天后,摩尔线程在首届聚焦全功能GPU的开发者大会上,围绕MUSA推出诸多新品,包括新GPU架构、芯片、智算集群和硬件产品,还将开源核心组件,构建生态,其架构创新定义未来AI产业格局。

量子位
算法论文8

RAE+VAE? 预训练表征助力扩散模型Tokenizer,加速像素压缩到语义提取

近期,RAE 提出以「 冻结的预训练视觉表征」作潜空间提升扩散模型性能。同期西安交大与微软亚研院提出 VFM - VAE,结合 RAE 与 VAE,能加速模型收敛、提升生成质量,展示扩散模型 Tokenizer 演化方向。

机器之心
产品应用8

Figure 03重磅发布!指尖能感知回形针重量,年产1.2万台,这次要让人形机器人走进千家万户

Figure AI公司发布第三代人形机器人Figure 03,专为Helix、家庭和大规模应用设计。它有全新传感与手部系统,能感知回形针重量,还做了安全、易用设计,实现低成本量产,适用于家庭和商业场景。

AI寒武纪
新闻资讯7

学哲学没出路?不好意思,现在哲学就业碾压CS!

2025年CS专业神话破灭,失业率飙升至6.1%,顶尖名校毕业生就业也难。原因是AI成裁员借口、行业裁员多、扩招致岗位饱和。市场更看重技能和经验,新岗位崛起,学生要积累经验破局。

新智元
产品应用8

面壁MiniCPM-V4.5新王炸!8B手机10FPS长视频秒懂,文档手写全能识别!

面壁上新最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。

CourseAI
新闻资讯8

从高考到实战,豆包大模型交卷了

火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。

机器之心
产品应用7

我手搓的橙皮书专家,去腾讯入职了!

作者将橙皮书方法手搓成「橙皮书专家」放于 QClaw 专家广场。该专家可把陌生领域拆成地图,通过五步流水线让使用者快速搞懂。QClaw 有多种造专家入口,普通人也能借其接 AI 红利。

花叔
算法论文7

GraphRAG还在持续进化,FlowRAG让证据链自己流起来

上海AI Lab和华东师大论文提出FlowRAG,它是GraphRAG变体,把RAG检索从按相似度排文本块推向沿证据流找推理路径。在多数据集上表现不错,虽平均Relevance低于LinearRAG,但更能保证证据链完整。

PaperAgent