黑盒测试框架」共找到 3137 篇相关文章

新闻资讯8

Anthropic创始人盛赞Meta:开启广告基础设施「智能体进化」时代

Meta最新论文揭示基于树状思维链搜索的智能体框架,以“无人驾驶”方式重写广告系统底层内核,将内核开发时间从数周缩至数小时,生产环境性能最高提升17倍,Anthropic创始人高度评价。

新智元
算法论文8

超94%类别第一!3D点云异常检测与修复新SOTA | ICCV'25

3D点云异常检测在制造等领域重要,但传统方法有丢细节、难修复问题。上海科大与密歇根大学团队提出PASDF框架,借助相关技术达成检测修复一体化,实验显示精准稳定,在两大基准上成绩优异。

新智元
新闻资讯8

陈天桥旗下AI公司MiroMind打造全球顶尖预测型大模型,性能登顶行业基准

全球首个动态实时LLM智能体未来预测基准FutureX推出,陈天桥旗下MiroMind团队连续两周蝉联冠军。其模型采用记忆驱动机制,为预测与决策设计,还展现了在多领域的预测能力,且将开放相关框架和模型。

机器之心
算法论文8

Meta-Think ≠ 记套路,多智能体强化学习解锁大模型元思考泛化

上海交通大学等团队提出ReMA框架,将复杂推理解耦为元思维和推理智能体,通过迭代强化学习协作。在单轮实验中,ReMA在多基准测试表现优;多轮实验虽有提升但不稳定,需进一步探索。

机器之心
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。

机器之心
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
推荐文章7

大模型微调知识与实践分享

文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。

阿里云开发者
算法论文8

训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式

大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。

深度学习自然语言处理
推荐文章7

什么是芯片可测性设计(DFT)技术?

在芯片复杂度增加、测试难度增大的背景下,DFT技术应运而生。它是在芯片设计阶段引入测试逻辑的方法,分功能和制造测试,有扫描链、MBIST、边界扫描等核心技术,能提高测试效率、降低成本、缩短开发周期。

芯师爷