「Agent自进化」共找到 3917 篇相关文章
阿里新研究:统一了VLA和世界模型
阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。
Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体
Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。
腾讯云黄世飞:企业如何构建面向未来的 AI-Ready 智能数据基座
本文是腾讯云副总裁黄世飞在腾讯全球数字生态大会的分享,介绍腾讯云AI - Ready数据平台建设进展,涵盖背景挑战、架构创新、生态落地等内容,还提及相关应用实践及未来规划。
Google Cloud 最新 AI 创业者报告:应用公司不用做自己的模型,速度和认知才是壁垒
Google Cloud 发布面向 AI 创业者的趋势报告,邀请众多创业者和投资人谈 AI 趋势等内容。给出创业者建议,如动作要快、深耕细分领域等,还探讨平台级应用机会、AI 应用壁垒、增长方法、出海素质及投资人看好的赛道。
无需训练,即插即用:西湖大学发布世界模型WorldForge,让普通视频模型秒变「世界引擎」
自Sora亮相,AI视频可控性成瓶颈。西湖大学AGI实验室团队提出WorldForge框架,在推理时为视频模型注入「时空几何」,无需训练,实现单图360°环绕视频生成和视频重运镜等,降低创作门槛。
神秘访客、智驾改革、增长放缓,这一年极氪调整了什么|甲子光年
极氪自2024年9月进入频繁调整期,经历组织架构和人事变动,如与领克合并、林杰接管营销等。但调整未显著提升销量,其独立性受冲击,资源被共享,现正重塑豪华品牌定位。
AI时代终端大变局
随着算法、芯片、场景深度融合,端侧AI计算成终端智能化核心引擎,重塑IoT终端应用场景智能体验。端侧AI芯片作为技术底座,正重塑终端产业格局,虽面临挑战,但未来前景广阔。
00后以1.1亿美金「掀桌」,硅谷AI将书写影视新传奇 终结制片旧时代
00后Cecilia Shen创立的Cybever转型为AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术经四个阶段进步,能生成高质量3D虚拟环境,还带来两部大剧,有望改变影视行业格局。
字节Seed最新版原生智能体来了!一个模型搞定手机/电脑/浏览器自主操作
字节Seed发布最新版原生智能体UI - TARS - 2,采用All in one原生设计,表现优于Claude和OpenAI Agent等。它通过多轮强化学习,解决智能体操作图形界面的四大难题,在多测试中表现出色。
最新研究揭示视觉模型与人脑的对齐机制
FAIR与巴黎高等师范学院通过训练自监督视觉Transformer模型(DINOv3),评估脑 - 模型相似性。发现模型大小、训练数据量和图像类型影响相似度,DINOv3学到的表征会逐步与人脑一致。