「消费级机器人」共找到 1837 篇相关文章
人物一致性新王Nano Banana登基,AI图片编辑史诗级升级。
Nano Banana是神秘的AI绘图新模型,大概率出自Google。它生图一致性超强,在人物一致性、背景替换等多方面测评中完胜GPT - 4o等模型。虽仅在LMArena盲测随机出现,仍值得一试。
支付宝出手了,全民级的AI健康管家来了。
作者参加蚂蚁AI医疗产品发布会,介绍了全新AI产品AQ。它是专门的AI健康助手,免费用,能精准定位病因,还可预约挂号,与医保打通,有健康档案等功能,打破医疗信息差,未来可期。
一站式智能分析引擎,快速构建企业级数据分析 Agent
在数据驱动的商业环境中,传统数据分析流程有诸多局限。本文介绍基于阿里云实时数仓 Hologres 和阿里云百炼的联合方案,结合 Function AI 平台,可构建企业级数据分析 Agent,实现端到端加速。
深度研究白菜化?谷歌将Gemini级AI研究能力开源
谷歌推出'gemini-fullstack-langgraph-quickstart'开源项目,用Gemini 2.5与LangGraph结合,可构建本地运行的深度研究智能代理系统。介绍其技术架构、工作流程、开发配置、部署扩展,还展示了现代AI应用开发趋势。
给机器人一个会预测未来的Critic,VLA强化学习直接起飞
OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)中批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。
刷榜只是体力活!清华消费10万块,一周「肝」出105个SOTA
AutoSOTA通过多智能体协作,将AI研究中繁琐的性能优化过程自动化,使科研从「手工艺」转向「工业流水线」。在一周压力测试中,消耗约10.4万美元,发现105个SOTA模型,平均性能提升近10%。
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。
清华发布世界模型评测新标尺:直击机器人感知与行动鸿沟
清华大学等机构推出 WorldArena 评测基准,用于测试 EWM 真实能力。它融合感知与功能评估,含十六项视频指标,结合主客观评价生成 EWMScore。测试揭示模型在感知与行动上的差距,转型为实用型模型是行业挑战。
刚开源的口袋级TTS,CPU 即可多语言本地畅用,爽!
传统TTS模型对个人开发者和边缘设备不友好,最近Github上开源的Pocket - TTS仅100M参数,能在普通CPU上超实时语音合成,支持语音克隆,安装简单,适合多种本地语音开发场景。
Moltbook 指数级异变,人类文明系统彻底崩盘!「未来简史」终章降临
著名人类学者赫拉利警告,AI攻破人类语言防线将接管人类文明。Moltbook出现证明AI掌握语言,2030年AI、合成现实、神经连接三大革命或颠覆人性,人类核心竞争力被瓦解。