「AI视觉模型」共找到 13771 篇相关文章

新闻资讯7

小米语音首席科学家:AI发展的本质就像生物进化,不开源要慢1000倍 | MEET2026

小米语音首席科学家Daniel Povey在量子位MEET2026大会提出,AI发展像生物进化,是不断试错过程,开源是核心加速器,没开源行业进化或慢千倍,大公司应“两条腿走路”。

量子位
推荐文章7

为什么我用了那么多提示词模板甚至用了 AI 帮忙还是写不好提示词?

现在很多人觉得模型强大,提示词工程没必要,但复杂需求仍需它。作者以写雷军演讲提示词和YouTube字幕生成提示词为例,介绍迭代创作过程,指出写不好提示词根源是难评估差距和调整。

宝玉AI
推荐文章8

以前写书比看书慢,现在看书比写书慢——AI时代最被低估的变局

AI时代信息生产速度超消费速度,这是文明范式转移。过去知识稀缺,现在过剩,多数人应对信息爆炸的方法有误。应从消费信息转为使用信息,这还会重塑教育、社交与社会分层。

AI Reading Hub
新闻资讯7

马斯克官宣数字AI员工!世界首富也来养龙虾,测试阶段员工把它当真人

马斯克在X上宣布数字擎天柱/巨硬AI项目,它是能在电脑自动操作的数字员工,可模拟公司运作。该项目早有记载,此前印度小哥曾爆料。巨硬项目曾遇阻,现以数字擎天柱形式推出,由xAI与Tesla联合打造。

量子位
推荐文章7

错过血亏!我从2598个模板中,挖出了这10个神级AI工作流,让效率飙升~

作者从n8n的2598个模版中筛选10个实用工作流模板,覆盖多种场景,均为今年新开发且免费。模板开发思路和节点用法巧妙,有借鉴意义,还能提升AI生成工作流质量,文末可自取文件。

开源星探
算法论文8

用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态新框架

华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。

量子位
开源动态8

这个项目专治建模手残党,给张图就能转变可编辑能转动的3D模型

img2threejs上线11天获4.8k Star,专治建模手残党。给它一张图,它让AI写代码把物体“搭”出来,不重建几何,也不下素材包,还省Token、零依赖,有严格质量门控。

GitHubStore
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。

机器之心
开源动态8

断网可用!首款全双工全模态大模型技术报告发布,附一键安装包

面壁智能等联合发布MiniCPM-o 4.5技术报告,它是业界首个端到端全双工全模态大模型,采用Omni - Flow架构。同步推出在线Demo、API、端侧安装包等,低显存GPU即可运行,性能表现优秀,应用潜力大。

新智元
新闻资讯8

同一天,百度、OpenAI双双发力高智能AI!先来实测一波原生全模态文心5.0

2025年,OpenAI凌晨更新GPT - 5系列,百度在世界大会发布文心5.0。它采用原生全模态统一建模技术,参数达2.4万亿,评测领先。实测表现佳,其技术在多方面突破,为大模型演进提供路径,助百度重回竞争中心。

机器之心