视觉 - 语言数据」共找到 3799 篇相关文章

新闻资讯7

通往 AGI 之路的苦涩教训

Google DeepMind CEO 预测 5 到 10 年有 50% 概率实现 AGI。本期《万有引力》直播对话将探讨通往 AGI 之路的教训。6 月 27 日,唐小引将对话刘嘉,从其学术轨迹解答 AI 路上的教训,还会剖析技术路径。

AI科技大本营
产品应用8

终于有AI视频模型,解决了体操难题。

前天深夜MiniMax发布Hailuo 02视频模型,虽未正式上线但放了预告片。该模型能生成杂技动作,解决了体操难题,在复杂动作肢体表现上吊打其他模型,还支持原生1080P,价格便宜。

数字生命卡兹克
推荐文章7

什么是芯片可测性设计(DFT)技术?

在芯片复杂度增加、测试难度增大的背景下,DFT技术应运而生。它是在芯片设计阶段引入测试逻辑的方法,分功能和制造测试,有扫描链、MBIST、边界扫描等核心技术,能提高测试效率、降低成本、缩短开发周期。

芯师爷
开源动态8

将对话界面直接引入Web,微软开源NLWeb,实现ChatGPT级别搜索

微软 Build 2025 开发者大会上,开源项目 NLWeb 受关注。它简化网站自然语言交互界面开发,原生支持 MCP,能让任意网站变智能应用平台,还可调用廉价模型,使用方便。

机器之心
开源动态8

图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025

360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。

AI科技大本营
开源动态8

哔哩哔哩献给二次元世界的礼物—AniSora,目前最强大的开源动漫视频生成模型

动画视频生成评估挑战大,现有模型处理动画视频力不从心。哔哩哔哩推出AniSora综合系统,支持一键生成多种动漫风格视频镜头,在角色和动作表现上出色,在多维度超越当前先进模型。

带你学AI
新闻资讯8

首发|数千万元种子轮融资,Articuler.ai 在职场社交找到了真痛点

本文首发报道硅谷AI驱动职业社交项目Articuler.ai完成数千万元种子轮融资,该项目聚焦职场人脉匹配痛点,从线下活动切入,已拓展至招聘、销售等ToB场景。

Founder Park
产品应用7

Fable 5.1变身Token刺客,几分钟烧光额度!AI圈掀起「榨汁革命」

Anthropic发布的Fable 5.1虽性能强但极耗Token,引发开发者不满。当前AI产业面临算力饥渴与Token通胀问题,企业落地AI痛点多。迅策科技的TokenCloud平台能助力企业高效转化Token,还介绍了其配套产品TokenOS。

新智元
7

苹果把OpenAI窃密细节全部暴露!但草台班子拼音都搞错了…

苹果与OpenAI窃密大战更新,苹果提交初步禁令申请及相关材料,指控OpenAI员工多次蓄意窃密。OpenAI回怼,称苹果虚构协商叙事,其指控无据,还质疑苹果权限管理。此前马斯克也曾起诉OpenAI。

量子位
新闻资讯7

Karpathy刚进Anthropic,转头又投了它

AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术降内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。

新智元