全自治智能体」共找到 4805 篇相关文章

新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,如Qwen3-Max对标顶尖模型,Wan2.5支持音画同出,Qwen3-VL开源且跑分出色,Qwen3-Omni是模态模型等。发布会上阿里股票涨飞,其构建了模态、场景超级生态。

数字生命卡兹克
新闻资讯7

小扎“超级智能”小组第一位大佬!谷歌DeepMind首席研究员,“压缩即智能”核心人物

最新爆料,谷歌DeepMind首席研究员Jack Rae确认转投Meta,另有消息称Meta还招募了Sesame AI的ML主管。此前小扎还想斥资150亿美元收购Scale AI。小扎为组AGI团队不遗余力,推进速度快。

量子位
新闻资讯8

Veo 3网实测惊艳所有人!DeepMind CTO:规模是AGI部吗?

谷歌推出视频生成模型Veo 3,一句提示词就能打造电影质感短片,还能音画同步,引发网友惊叹。DeepMind CTO在访谈中表示,规模非AGI唯一要素,还提及Deep Think模式及Veo 3进展等。

新智元
推荐文章7

别再四处找教程了,OpenClaw 网最接入方式替你整理好了

OpenClaw爆火,但安装劝退很多人。作者梳理其接入方式,有手动、AI一键安装等,还介绍替代品及大厂云端部署方案。另外提到代装服务,强调先用上探索其边界很重要。

特工宇宙
新闻资讯7

GPT正面对决Claude!OpenAI竟没赢,AI安「极限大测」真相曝光

OpenAI和Anthropic罕见合作,测试双方模型在幻觉等四大安方面的表现。这场合作是AI安的里程碑,百万用户每天的互动推动安边界扩展。文中详细对比了GPT和Claude模型在各安测试中的表现。

新智元
算法论文8

图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
开源动态8

突破模态AI理解边界:引入上下文强化学习,赋能模态模型“意图”推理新高度

在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位
开源动态8

恐怖的 361k+ star!这应该是我见过最给力的宝藏项目,网最

介绍GitHub上的开源项目`free-programming-books`,它汇集海量免费编程学习资源,涵盖编程语言、框架、工具等多方面,有361k+ star。资源广、更新快、结构清、支持多语言,使用简单。

开源先锋
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
算法论文7

Theory of Agent:构造知行合一的智能

当前AI(如ChatGPT)存在行为随机性、效率黑洞等问题,论文指出AI缺乏认知地基,需明确认知框架。还提出革命性等式“推理 = 行动”,分析了知识与决策边界,给出最优行为四象限,介绍落地路径和未来发展方向。

深度学习自然语言处理