「多模态技术」共找到 3527 篇相关文章
MIT团队完成AI控制人类行为实验项目
MIT团队的Human Operator项目是实时人体增强工具,也是MIT Hard Mode 2026获奖项目。它通过视觉 - 语言模型结合电刺激肌肉实现人体运动控制,介绍了技术栈、环境要求、软硬件准备、安装步骤等。
库克不忍了!挥刀优化苹果AI大总管
苹果官宣AI负责人John Giannandrea卸任,其领导下苹果AI团队落后同行,新版Siri推迟发布。同时,苹果从微软挖来Amar Subramanya出任AI副总裁。此外,苹果机器人技术负责人Yilun Chen跳槽特斯拉,军心涣散。
“双英”同框解释“算力联姻”:眼前的恩情未来的路
北京时间9月19日凌晨,英伟达黄仁勋与英特尔陈立武同屏直播,解释英伟达50亿美元入股英特尔事宜。双方将融合技术,构建AI计算基座,瞄准近500亿美元市场,投资也会影响产业竞争格局。
成本砍半!国产黑马攻破机器人「瘫痪」难题,大厂纷纷上车
深圳机器人产业生态优越,产业链完整。小象电动聚焦轴向磁通路线,实现技术突破,累计出货近7万台,进入华为等大厂供应链,完成超亿元融资,体现深圳产业链整体优势。
字节豆包2.0重磅发布!成本暴降一个数量级,Seed团队揭秘视频Agent竞争关键
今天,字节正式发布豆包大模型 2.0 系列,围绕大规模生产环境需求优化,提供多款通用 Agent 与 Code 模型。其成本优势明显,多模态能力升级,未来将聚焦长链路智能系统构建。
刚刚,Anthropic分享了构建Skills的最佳实践
Anthropic获300亿美元融资,估值达3800亿美元,发布《The Complete Guide to Building Skills for Claude》指南。介绍Claude Skills本质、与MCP关系、应用场景、技术实现、设计模式及测试迭代方法。
突破通用领域推理的瓶颈!清华NLP实验室强化学习新研究RLPR
现有基于可验证奖励的强化学习(RLVR)应用范围局限,清华自然语言处理实验室提出 RLPR 技术,通过 Prob - to - Reward 提高概率奖励质量,有领域无关等特点,相关代码等已开源。
刚刚,全球视频模型新王诞生了!
天工AI的SkyReels-V4直接登顶Artificial Analysis文转视频全球榜,超越Veo 3.1、Sora 2。其相比之前有两大核心升级,让视频生成从‘生成片段’走向完整视频生产,还应用于短剧平台DramaWave。
在参与OpenAI、Google、Amazon的50个AI项目后,他们总结出了大多数AI产品失败的原因
Aishwarya Naresh Reganti 和 Kiriti Badam 参与超50个企业级AI产品构建。他们指出,如今AI产品构建成本降低,但多数仍失败。还分享开发陷阱与路径,如从低自治高控制起步、建立CC/CD框架等,也对AI未来发表看法。
奶牛版 Oura 估值 10 亿美金,AI+PDF 让它拿了 1700 万美金融资
市场上多数AI PDF产品是ChatPDF模式,用于C端。企业关键非结构化数据多在PDF等传统载体中,难以获取。硅谷工程师做的Extend AI产品,获1700万美金融资,解决传统文档处理难题,打造平台。