功能测试」共找到 3143 篇相关文章

算法论文7

Meta全开源HumanCLAW:基础模型正进入具身智能的决策层

过去基础模型主要理解和描述物理世界,如今开始进入机器人控制栈。Meta等提出HumanCLAW,将高层行动与低层运动控制分开。评测显示当前模型在行动决策上存在不足,未来可从多方向推进研究。

机器之心
开源动态8

给Agent加上知识图谱,开源版Palantir

Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片化企业数据变成结构化、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。

GitHubStore
新闻资讯8

Claude一举扫清2000阶以下哈达玛矩阵!AI开始清空数学“待解列表”

Anthropic研究员携手Claude做出668阶哈达玛矩阵,解决该问题。此问题曾难倒人类数学家30年,被收录进FrontierMath基准测试。此次还扫清2000阶以下所有悬而未决的哈达玛矩阵阶数。

量子位
推荐文章8

改写纳米光学底层逻辑!MIT学者搭建通用可重构光子平台

MIT助理教授唐皓凝构建可相对运动的双层纳米光子系统,将机械运动变为可定量科学变量。2024年,她和合作者集成光谱仪和偏振仪功能。她想发展可编程光子架构,还把AI作工具。

DeepTech深科技
产品应用7

880 万粉的胡楚靓,带火了 AI 工作台,人人可拥有定制 App?

穿搭网红胡楚靓引领用AI做适合自己工作台的热潮,粉丝创意十足。文中介绍胡楚靓工作台及配置抓取功能方法,还展示粉丝做的旅游、美食等多种工作台,最后给出新手落地操作办法。

鲸选AI
推荐文章7

AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?

《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。

特工宇宙
开源动态8

当「变大」不再是唯一的路,又一国产模型开源了

2026年6月智谱开源GLM - 5.2,心洲科技前沿实验室Mind Lab开源Macaron - V1,基座升级至GLM - 5.2。它押注持续学习与群体智能,成绩优于基座,相关理念和工程路径获验证。

机器之心
算法论文8

满分的「差」,Qwen与复旦等揭示编程智能体奖励设计的结构性困境

Qwen团队与复旦等联合发表论文《The Verification Horizon: No Silver Bullet for Coding Agent Rewards》,指出编码智能体奖励设计存在结构性困境,任何奖励信号只是人类意图的‘替身’,验证需成系统与智能体协同演化,并研究多种验证者。

机器之心
产品应用7

Claude Code 新功能 Agent Teams:4 类活效率翻倍,4 类活纯烧 token

Claude Code v2.1.32 后新增实验性功能 Agent Teams,可将其从单个 AI 助手升级为 AI 团队,但会使 token 用量线性放大。文章总结了适合和不适合用此功能的任务类型,还给出决策清单、实战避坑建议。

AI Reading Hub
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。

小华同学ai