智能测试平台」共找到 5759 篇相关文章

开源动态8

首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS

EverMind团队发布面向人工智能智能体的长期记忆操作系统EverMemOS。它在主流评测集表现超此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。

机器之心
产品应用8

当搜索遇见 AIGC:京东零售的“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并预告新能力,推动电商个性化变革。

InfoQ
新闻资讯7

奥特曼和量子计算奠基人讨论GPT-8

奥特曼在节目中与量子计算奠基人戴维・多伊奇就AI能否发展成有意识的超级智能产生分歧。奥特曼搬出GPT - 8举例试图说服对方,引发网友对AGI定义标准的讨论。

量子位
新闻资讯8

内幕曝光:OpenAI模型坦承不会第六题,3人俩月拿下IMO金牌!

OpenAI三人团队俩月让AI达IMO金牌水平。他们用多智能体系统技术,使模型能短时间解复杂问题。新模型有自省能力,减少“幻觉”问题。此次突破是通用推理技术进步,未来将整合进更多模型。

新智元
产品应用8

一个模型场景通吃!它石智航AWE3.7的泛化能力有点狠

长期以来,机器人系统多依赖专有模型,场景变化时需重新训练。如今具身智能步入下半场,它石智航通用具身大模型AWE3.7用同一颗“具身大脑”贯通多场景,回应了通用泛化命题。

量子位
产品应用7

对话 Funloom AI吴同:拆了AI还能玩,算什么AI原生游戏?

本文对话Funloom AI吴同,探讨AI游戏现状与发展。以《青椒模拟器》为例,指出AI游戏潜力。介绍Funloom平台,能让用户轻松生成文字游戏,分析其与开源项目差异、商业模式及对AI原生游戏看法。

AI科技评论
算法论文8

超越Skill?又一新技术让AI编码准确率从53%跃升至100%

Jude Gao主导的新研究带来上下文工程新发现,仅改动8KB的AGENTS.md文件,就让AI编码智能体表现从53%跃升至100%。对比Skills和AGENTS.md两种方案,后者完胜,还解决了上下文膨胀问题。

AI工程化
推荐文章8

刚刚,Cursor又分享了数百Agent并发协作的最佳实践

Cursor分享数百Agent并发协作最佳实践,讲述单个Agent局限,介绍从多方面探索协同方法,如规划者与执行者分工,还展示多个实验成果,总结模型选择等经验,指出多智能体协同仍待优化。

PaperAgent
新闻资讯8

Chiplet(芯粒) —— 后摩尔时代的芯片“乐高”玩法

当单芯片逼近物理极限,Chiplet技术应运而生,它将大芯片拆分成小芯片,通过先进封装技术整合。该技术成本低、良率高,应用场景多元,但面临热管理、测试和标准统一等挑战,未来发展前景广阔。

芯师爷
新闻资讯7

狂奔AGI,Claude年终封王!自主编码近5小时震惊全网

METR报告称Claude Opus 4.5能持续自主编码5小时,超OpenAI最强编程模型。AI编码智能体任务时长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。

新智元