「文本智能技术」共找到 5867 篇相关文章
两张图就能重构3D空间?清华&NTU利用生成模型解锁空间智能新范式
ICCV 2025中稿的LangScene-X以全新生成式框架,仅用稀疏视图就能构建可泛化的3D语言嵌入场景。它攻克传统方法痛点,将多模态信息统一在单一模型,为空间智能领域打开新大门。
开源·开放·开创,2025张江具身智能开发者大会暨国际人形机器人技能大赛即将启幕
5月29日,2025张江具身智能开发者大会暨国际人形机器人技能大赛将在张江科学会堂启幕,集“峰会+大赛+展览”于一体。现场将发布政策、成立联盟、启动平台与基金,推动产业发展。大赛设五大赛道,展示创新活力。
Google 发布首个全模态 Embedding 2 模型,文本图片音视频 PDF 统一到一个向量空间
Google发布Gemini Embedding 2模型,它是业界首个原生支持文本、图片、视频、音频和PDF五种模态的Embedding模型,可将这些数据映射到同一向量空间,在多模态RAG、跨模态搜索等场景有应用,还介绍了跑分、用法、竞品、价格等情况。
AI圈两件大事,Meta超级智能实验室大规模裁员,OpenAI新发布的浏览器遭全网差评。
近期AI圈热闹非凡。Meta超级智能实验室裁员600人,包括资深人员田渊栋,或因前期扩张致团队臃肿。而OpenAI新发布的浏览器Atlas仅Mac版,口碑差,功能不新鲜,产品成熟度和体验欠佳。
4.55亿美金!中国具身智能最大单笔融资诞生,高瓴红杉联手押注具身大脑
近日,成立仅一年的它石智航完成4.55亿美金Pre - A轮融资,刷新中国具身智能最高单轮融资纪录。高瓴、红杉等20余家机构投资。其战略重投大脑和人才,大脑AWE 3.0能力突出,还在高难度场景落地领先。
大神Karpathy炮轰复杂UI应用没有未来,Adobe首当其冲,网友:不提供文本交互,就是在阻挡AI浪潮
大神Karpathy预言只有复杂UI界面、不提供文本交互的应用将被淘汰,还点名Adobe、CAD。他言论引发讨论,支持者强调后端接口,反对者认为专业软件有其价值。此外,他还批判大模型编程‘重生成轻判别’。
亚马逊云科技大中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三大技术准备
亚马逊云科技大中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于大模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三大技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。
鸿蒙元服务的“体验密码” | 从京东到深圳万象城,看技术底层如何让服务直达用户
AI时代,系统能感知用户场景与需求,主动推送服务。鸿蒙元服务解决用户体验痛点,其技术底座帮开发者“减负”。如京东复用代码,深圳万象城优化停车服务,还为中小商户提供零代码开发方案。
斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量大模型
斯坦福大学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像大模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。
OpenAI深夜甩出GPT-5.1,称更热情,更智能!网友狂吐槽:我不想和它聊天,只想用它工作
OpenAI发布GPT-5.1,包括Instant和Thinking两个版本,称更智能、对话更愉快,还增加“个性/语气”选项。但网友质疑“强化个性”方向,想要高效工具而非“虚拟朋友”。