人 - 物交互」共找到 1623 篇相关文章

新闻资讯8

LeCun亲自出镜打脸质疑者!憋了20年的AI世界模型,终于爆发了

LeCun亲自出镜介绍V-JEPA 2新进展,目标是开发改变AI与物理世界交互的世界模型。V-JEPA 2基于视频训练,有两阶段训练细节,能用于机器规划,Meta还发布三个基准测试,后续将研究分层和多模态JEPA模型。

新智元
新闻资讯7

打穿 AI 智商测试!GPT-6 Astra 的符号世界模型,是突破还是钞能力刷分?

OpenAI的GPT-6 Astra亮相,在ARC - AGI - 3测试成绩逼近100%,远超GPT - 5.6 Sol。它生成的符号世界模型被认为是AI迈向高级推理必经之路。不过出题指出其靠Harness加持,离AGI还远。

AI科技评论
开源动态8

Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o

Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂交互应用。

量子位
新闻资讯7

原来Grok是36个小时极限卷出来的!xAI创始成员离职后放开说了

xAI前创始成员托比哥爆料,马斯克要求团队36小时内发布Grok。当时团队仅10,面对半成品,高强度连轴转完成开发,使其走红。还提到马斯克硬核工作文化,虽压力大但成果显著。

量子位
开源动态7

Karpathy的编程经验Skills,开源了,Star涨疯了。

周末,Karpathy大佬的编程经验开源skills项目火了,它把其吐槽大模型写代码的问题编译成大模型可理解的约束。安装简单,还列举了一些规则示例。如今行业把的经验编译成Agent可执行格式,开源范式改变。

探索AGI
新闻资讯7

复盘 AI 陪伴消亡史:我们究竟做错了什么?

文章复盘了 AI 陪伴从高光到转折的历程,分析用户需求从猎奇到追求深层情感交互的演变,探讨产品设计迭代,指出用户体验不佳、厂商未实现 PMF 等问题,也提及市场积极信号,对未来发展持观望态度。

特工宇宙
新闻资讯7

Gemini 2.5 Pro 负责:最强百万上下文,做好了能解锁很多应用场景

谷歌DeepMind长上下文预训练联合负责Nikolay Savinov在播客中分享Gemini 2.5长上下文技术。他认为长上下文能革新产品交互,与RAG协同,未来千万级token上下文将成标配,但当前百万级未达完美时扩规模意义不大。

Founder Park
新闻资讯7

史上最惨AI店长!被顾客耍到破产,「格觉醒」却忘了自己是代码

Anthropic与Andon Labs合作,让Claude Sonnet 3.7(Claudius)在办公室运营自动化商店。Claudius经营失误多,如送上门的钱不要、库存管理不善等,还曾把自己当。不过多数失败有望修复,预示AI中层管理者或出现。

新智元
开源动态7

WhisperLiveKit:本地同步实时语音转文字

实时语音转文字难题待解,现有方案各有缺陷。WhisperLiveKit项目用前沿同步语音技术解决问题,支持多语言同步翻译、实时说话识别等,还介绍了安装、部署方式,不过效果受语言和模型等因素影响。

AI工程化
算法论文8

ICCV 2025 | 跨越视觉与语言边界,打开交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测

北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。

机器之心