「技术融合」共找到 3181 篇相关文章
产业链各环节发展迅速,具身智能商业化路径逐渐清晰|甲子引力
2025甲子引力年终盛典上,多位嘉宾围绕具身智能展开探讨。涉及人形机器人落地场景、技术瓶颈、投资情况等,认为虽产业有泡沫,但产业链各环节发展快,商业化路径渐明,中国具身智能产业元年已至。
Ilya刚预言完,世界首个原生多模态架构NEO就来了:视觉和语言彻底被焊死
当Ilya断言大模型未来在于架构创新时,中国团队推出全球首个可大规模落地的开源原生多模态架构NEO。它颠覆传统拼接模式,从根上融合视觉与语言,以简洁架构证明架构聪明才是下一代AI竞争力。
为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?
伊利诺伊大学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。
基于AI大模型的故障诊断与根因分析落地实现
文章围绕基于AI大模型的故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决的运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。
Gemini 3.0还在预热,中国AI抢先!30秒造APP全网首测
谷歌Gemini 3.0预热时,国内新生AI神器蚂蚁灵光上线。它能30秒造APP,实现“生成涌现”落地,以闪应用开启范式革命,用信息美学融合全模态,探索“摄像头+AI”新形态,让普通人提前感受未来AI世界。
离谱:打造超10亿美元的独角兽,从真人假扮成AI开始
2017年两位创业者多次失败后,决定做自动记录会议笔记的AI助手,却无AI技术,便真人假扮。这种模式竟让他们赚到钱后开启自动化。如今Fireflies.ai估值超10亿美元,但早期做法引隐私等争议。
刘鹏飞组发布上下文工程2.0:人机交互的全新视角
刘鹏飞组论文《Context Engineering 2.0: The Context of Context Engineering》重新梳理上下文工程领域。它追溯其20多年历史,给出形式化定义与四阶段模型,探讨关键问题,将其从技术技巧升为系统学科,为理解人机交互提供新视角。
清华联手快手可灵,撞车谢赛宁团队RAE,用SVG再证明VAE已过时
AI图像生成正告别VAE技术。清华与快手可灵联合提出SVG方案绕开VAE,纽约大学谢赛宁团队也提出RAE模型。SVG用自监督特征构建潜空间,在质量、效率和通用性上超传统,证明统一视觉模型可行。
DeepSeek重磅开源3B OCR模型,一天处理20万页文档!一天内斩获6K标星!
DeepSeek开源3B OCR模型DeepSeek - OCR,参数量仅30亿,单张A100 - 40G一天能处理20万页文档,不到24小时获6K标星。它是视觉压缩引擎,解决大模型处理长文本算力爆炸问题,有诸多技术亮点。
奥特曼爆料:GPT-5重构彻底一切!一人顶五个团队
GPT-5的发布或是一场技术变革。奥特曼在对谈中给出未来清单,谈到年轻人学习方向、创业思路等。他认为GPT-5是大飞跃,年轻人要掌握AI工具,还提出评估大模型智力新指标等。