感知级评估」共找到 1881 篇相关文章

开源动态8

突破具身智能任务规划边界,刷新具身大脑多榜单SOTA,中兴EmbodiedBrain模型让具身大脑学会「复杂规划」

当前主流大语言模型在具身任务场景面临瓶颈,中兴星云大脑团队推出具身视觉 - 语言基础模型 EmbodiedBrain,构建全流程创新框架,在架构、数据训练、评估体系等方面有突破,还将开源成果推动生态发展。

机器之心
产品应用8

终于,TRAE SOLO全量开放,我们用它复刻了PewDiePie的大模型智囊团

2025年AI Coding赛道上,TRAE是国产AI IDE代表作。7月其SOLO Beta版反响好,如今正式版全量推送。它定位为‘具备响应感知的编程智能体’,新增功能,还限时免费体验,实测显示开发能力强。

机器之心
新闻资讯8

阿里云秘密武器亮相顶会:狂砍82%英伟达含量,213块GPU干了1192块的活

阿里云与北大合作,由CTO周靖人带队的研究提出GPU池化系统Aegaeon,亮相顶会SOSP。它用token自动扩缩容技术,将GPU使用量从1192个减到213个,提升了资源利用率,还在百炼平台测试成功。

量子位
推荐文章8

相比层出不穷的 Agent 框架,不变的 Agent Protocol 是什么

文章围绕 Agent Protocol 展开,指出框架更迭但生产 Agent 系统问题不变。以 Agent Protocol 为主线拆分 Agent Runtime,探讨其核心、稳定对象、执行模型等,还对比各框架在多维度的表现并给出设计建议。

阿里云开发者
8

“10周的工作量,AI只用4天!”Anthropic发布会全程实录:你引以为傲的复杂工程,在模型眼里只是个玩具

Anthropic举办‘Code w/ Claude’开发者大会,指出AI模型能力呈‘指数’增长,多数企业开发模式却停留在‘线性’阶段。大会祭出三大杀手锏,包括更强底层模型、Claude Platform代理编排能力和Claude Code桌面端。

AI科技大本营
算法论文8

具身AI当立!这是我分析完7篇最新Paper得出的结论~

作者分析7篇来自蚂蚁、小米、高德的具身AI论文,认为行业要变天。蚂蚁打通全链路并开源,小米让VLA在消费显卡跑,高德重构数据和架构。具身AI正从‘手工业’走向‘工业革命’。

PaperAgent
算法论文8

从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践

当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。

机器之心
产品应用7

机器人WAIC现场抢活讲PPT?商汤悟能具身智能平台让机器人「觉醒」

具身智能火爆但面临数据瓶颈等难题。商汤在WAIC推出具身智能平台「悟能」,以世界模型为引擎,有感知、导航、交互等功能,其开悟世界模型能生成多视角视频,为机器人提供数据支持。

新智元
产品应用7

这才叫AI原生应用:Google Slides

Google Slides是Google版AI PPT,与传统AI PPT不同。它像传统PPT搭配AI聊天机器人,用Nano Banana模型可直接生成图片和文字,能像素推理,打破传统PPT结构,还可自然语言交互修改,只是中文生成效果待提升。

newtype AI
开源动态8

腾讯混元推出首款开源混合推理模型:擅长Agent工具调用和长文理解

6月27日,腾讯混元开源首个混合推理MoE模型Hunyuan - A13B,参数80B激活仅13B,推理快性价比高。它在多测试集成绩好,尤其擅长Agent工具调用和长文理解,还开源两数据集填补评估空白。

AI前线