动态环境」共找到 811 篇相关文章

产品应用7

如何让AI帮你做前端自动化测试?我们这样落地了

本文介绍阿里基于AI的UI自动化测试框架在专有云质量保障的实践。框架用开源browser - use等工具,采用自然语言驱动用例、动态元素定位等机制,还应对了大模型幻觉等挑战,也提及构建企业级数据分析Agent方案。

阿里云开发者
开源动态8

一键式训练端到端Agent,Qwen3+MCP工具集高效集成!

RLFactory是开源的端到端RL后训练框架,将环境与训练解耦,用Qwen3基座调用MCP工具集,可低代码训练端到端Agent模型。它极致易用、训练高效,还支持一键式训练,未来会更易用高效。

深度学习自然语言处理
新闻资讯7

新版Claude曝光:“极限推理”成最大亮点

O家刚免费上线GPT - 4.1,A家新版Claude Sonnet和Claude Opus被曝即将发布,亮点是“极限推理”,能在推理和工具使用间建立动态循环,更智能处理问题,预计未来几周发布,虽有网友质疑,但也有实测证据。

量子位
产品应用8

一张图生成雕刻级 3D 模型,效率拉满,绝了!

Hi3D是商品级3D模型生成工具,在Hugging Face上连续三周霸榜下载第一。其2.0版本能自动补全不可见结构、消除环境光干扰、优化人像细节。操作简单,还有多种玩法场景,官方还提供兑换码福利。

开源先锋
推荐文章7

LightX2V Ulysses Attention 实现学习笔记

本文记录了LightX2V中Ulysses Attention的实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。

GiantPandaLLM
开源动态8

VerseCrafter:给视频世界模型装上4D方向盘,精准运镜控物

复旦大学与腾讯等机构提出VerseCrafter,这是通过显式4D几何控制实现的动态逼真视频世界模型,能精准控镜和指挥物体3D运动。它用独特方法构建4D可控世界模型,实验超现有SOTA方法,代码与模型已开源。

机器之心
产品应用8

两个月前的预测成真:千问APP真的打通了阿里生态

近期AI圈动态频出,Google与沃尔玛合作搞AI购物,Anthropic发布Claude Cowork。而阿里千问App更快一步,1月15日成功接入淘宝、闪购等实现AI购物与办事。千问基于阿里生态打通内部,具备强模型与丰富生态优势。

花叔
开源动态8

Google开源MCP数据库工具箱轻松连接各类数据库

近日Google开源新项目genai - toolbox,它是为数据库设计的MCP服务器,能让开发者用不到10行代码将数据库工具集成到AI应用。该项目封装复杂问题,有动态工具注册机制,支持主流数据库,提供多语言SDK和多种部署方式。

AI工程化
新闻资讯8

刚刚,首个能在机器人上本地运行的具身Gemini来了

谷歌DeepMind推出Gemini Robotics On-Device,这是首个可部署在机器人上的VLA模型,无需联网,能让机器人适应新任务和环境。还将发布SDK助开发者评估。此外,谷歌下调Gemini免费额度,推出图像生成模型Imagen 4和Imagen 4 Ultra。

机器之心
开源动态8

MiniMax开源首个视觉RL统一框架,闫俊杰领衔!推理感知两手抓,性能横扫MEGA-Bench

MiniMax开源首个视觉RL统一框架V-Triune,由闫俊杰领衔。该框架通过三层组件设计和动态IoU奖励机制,让VLM能联合学习推理和感知任务。还开发Orsta模型系列,在MEGA - Bench表现出色,且MiniMax多模态布局动作多。

量子位