「艺术与科技」共找到 7177 篇相关文章
阿里通义开源GUI智能体SOTA:2B到235B端云协同重新定义移动端GUI智能体
阿里通义实验室开源MAI - UI,通过端云协同架构等解决GUI智能体部署难题。它全谱系模型设计应对硬件约束,自进化数据管线和在线强化学习提升性能,端云协同平衡隐私与效率,扩展动作空间打破局限,在多基准测试创SOTA。
读万卷书,大模型就能「看」懂视觉世界?Meta揭秘LLM视觉先验的起源
Meta超级智能实验室与牛津团队新论文发现,只见过文本的大语言模型(LLM)能学到可迁移到视觉任务的先验能力。研究通过超100组受控实验、耗费50万GPU小时,揭开LLM视觉先验来源,还给出预训练数据配方。
对话Memories.ai沈俊潇:用视觉记忆驱动物理AI自进化
DeepTech专访前Meta研究员、Memories.ai创始人沈俊潇,介绍公司聚焦视觉记忆领域,以视觉记忆驱动物理AI自进化,解决物理AI数据标注痛点,已获融资并与高通、英伟达合作,形成清晰的商业数据飞轮。
把人类驾驶员赶出机场,复旦大牛校友要港股IPO了
4月19日,驭势科技通过港交所聆讯,这是其第二次冲击IPO。它是全球唯一为机场提供大型商业营运L4级自动驾驶解决方案的供应商,主营车辆、软件、套件解决方案及车辆租赁服务,业务聚焦智慧民航、厂区、城市三大赛道。
独家 | 前理想智驾端到端负责人夏中谱去向敲定,将加入某明星具身创业公司
AI科技评论独家获悉,前理想智驾端到端负责人夏中谱将加入具身创业公司。他曾实现国内首个智驾端到端量产落地,因理想“翻身仗”战功连跳两级,其对VLA路线的判断也得到印证。
对话ACE Studio:做AI音乐、月收入200万美元,我们选了一条和Suno截然不同的路
ACE Studio 切入 AI 音乐市场,与 Suno 路径不同,从专业用户入手,月收入达 200 万美元。其模型轻且快,还自建专家模型矩阵。商业模式采用开源免费吸引用户,闭源变现。认为 AI 音乐个性化是关键,未来将改变音乐产业。
前端工程化演进之路:从手工作坊到AI驱动的智能化开发
本文回顾前端开发从jQuery到AI的变革,剖析工程化演进、性能优化进化,展示AI与前端深度融合新范式。还预测未来趋势,为开发者提供成长路径指导,强调工程化、性能优化、AI应用及持续学习的重要性。
黄仁勋中国现场直击!假如有一个「数字黄仁勋」,我希望我们一起变聪明
英伟达CEO黄仁勋再访北京,接受新智元等媒体采访。他盛赞华为优秀,评价DeepSeek等模型出色,还谈及AGI、数字分身、出口管制等话题。此外,H20芯片解禁重售释放政策信号,有望实现中美科技企业合作共赢。
马斯克破大防了:私信求和遭拒,怒喷奥特曼Brockman「全美最恶人」
马斯克与OpenAI两兄弟庭审进入第二周,马斯克曾发短信提议和解遭拒后破防威胁。短信虽未作庭审证据,但舆论偏向OpenAI,其胜诉率下降。Brockman出庭承认报酬是次要动机,双方各亮手牌,后续奥特曼等将出庭。
大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力
现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。