「混元世界模型HY - World 1.5」共找到 4042 篇相关文章
UI-TARS-desktop:字节跳动的原生GUI智能体,用自然语言控制电脑和浏览器
字节跳动开源的UI-TARS-desktop是原生桌面GUI智能体工具,基于UI-TARS和Seed-1.5-VL系列模型。能用自然语言操控电脑和浏览器,有本地和远程两种模式,支持多平台,还对比了同类工具。
魔法原子登陆硅谷,行业首个「自进化具身大脑」发布
美西4月28日,国内具身智能企业魔法原子在硅谷主办全球具身智能创新大会。会上发布全域世界模型Magic - Mix、新一代灵巧手H01、旗舰人形机器人MagicBot X1,直面行业痛点,还披露全球化战略目标。
糟糕,Claude Opus 4.7源代码级提示词曝光!底层设计全被看光
Claude Opus 4.7如期而至,性能全方位提升,编程暴打Gemini 3 Pro、GPT - 5.1。Claude Code之父分享最佳实践,还曝光系统级提示词,揭示其进化逻辑,此外还提及Mythos的一些危险操作。
让LLM扔块石头,它居然造了个投石机
港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,多个模型测试表现良好。
AI操作有了“紧急刹车”!通义&自动化所AI决策诊断模型,GUI智能体纠错正确率SOTA
阿里通义实验室与中科院自动化所推出GUI - Critic - R1模型,能在GUI智能体操作执行前诊断决策,避免错误。介绍了其动机、方法、数据集及实验,证明该模型在生成判断和提建议方面有效。
Google研究发现:Multi-Agent的核心竟然是Prompt设计!
Google和剑桥大学研究多智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比多种方法,在多任务上性能显著提升。
ChatGPT开测广告!OpenAI终于向“钱”看
OpenAI宣布在美国免费版及Go版测试ChatGPT广告功能,称是为支撑免费用户使用。广告不影响回答内容,会注明“赞助内容”。此外,新发布的GPT - 5.3 - Codex广受好评,还将推新聊天模型,其融资计划也在升温。
AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年
2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究新架构。小模型崛起、智能体互联标准化、世界模型构建及物理智能落地成趋势。
自写驱动越狱!Gemini 3 Pro零败绩通关宝可梦:效率碾压前代8倍「Agent进化太快了」
在全自动《宝可梦 水晶版》对决中,Gemini 3 Pro击败Gemini 2.5 Pro,通关速度至少快2倍,前代或慢8倍。它还展现出诸多能力,如自写驱动绕过限制等,但也存在不验证假设等局限。
19岁少年用计算机炼出「神药」,斩获全球大奖!大厂看了都沉默
19岁斯洛伐克少年Adam Kovalčík用计算机模拟设计新分子,提出新合成方法,有望将抗RNA病毒药物Galidesivir成本降6倍,还设计出对新冠抑制效果或达Galidesivir 5倍的新分子,获全球青少年科研大奖。