工具设计」共找到 2992 篇相关文章

开源动态8

国产模型新盛况!王座易主:Kimi K2 Thinking开源超闭源

月之暗面开源 Kimi K2 Thinking 模型,多方面性能超 GPT - 5 等闭源模型。它擅长多轮调用工具和持续思考,在多项基准测试达 SOTA 水平,成本低且授权宽松,引发全网讨论。

机器之心
算法论文8

单张4090跑到30fps,范浩强团队让VLA实时跑起来了

Dexmal原力灵机团队在RT - VLA论文中公布,常用Pi0级30亿参数VLA模型在单张RTX 4090上最快能跑30fps。他们深入分析优化模型,成果已开源,还设计了未来控制框架。

机器之心
算法论文8

Meta打开AI元认知,让AI不止会解题,还会总结套路了

Meta等机构提出‘元认知重用’机制,让大模型学会反思总结。大模型打造‘行为手册’,与主流RAG系统有本质区别。研究人员设计三种实战用法,虽有局限,但为大模型推理难题提供了解决方案。

AIGC开放社区
推荐文章7

证书透明度如何重塑互联网信任

文章探讨引入证书透明度(CT)的原因、工作原理及对数字信任的意义,揭示CA机构信任危机,介绍CT架构和实践工具,还展望其未来创新,如Static Sunlight API、委托凭据等。

InfoQ
开源动态8

开源 x AI 的靠谱答案,都在这场嘉年华里了 | Q推荐

2025 Inclusion·外滩大会期间的开源嘉年华,用“上手体验 + 实战分享”回应开发者、创业者需求。创新舞台有精英分享,代码原生地可实操MCP工具,有童心趣工坊、互动展区等,助力开源生态发展。

InfoQ
算法论文8

大模型Agent的下一阶段:可自我进化的AI-Agent

在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。

AINLPer
算法论文7

Anthropic最新研究:Claude存在神秘J空间,与人类心智高度相似

Anthropic研究团队在Claude中发现类似人类大脑工作机制的J空间,它存在于模型神经激活中,能让模型默默思考。失去J空间Claude在多步骤推理任务表现变差,还可暴露模型意图,团队已创建演示工具JLens。

AI寒武纪
新闻资讯7

十分钟出结果,陶哲轩用Gemini Deepthink帮人类数学家完成Erdős问题论证

Erdős问题网站专注数学研究与解答,收录厄尔德什提出的各类数学问题。11月20日,Wouter van Doorn提出反例,陶哲轩提交给Gemini 2.5 Deep Think,十分钟得到证明,他半小时转为基础证明。之后Boris Alexeev用Harmonic的Aristotle工具完成形式化。

机器之心
开源动态8

五百行代码打造SOTA视觉智能体!UniPat AI最新开源

多模态大模型代码能力强,但基础视觉任务常失误。UniPat AI推出极简视觉智能体框架SWE-Vision,让模型用代码弥补视觉短板,在五个主流视觉基准测试达最优。该框架设计独特,开源代码和数据已发布。

量子位
新闻资讯7

AI也能换岗了!Anthropic教智能体交接班,不怕长任务断片

Anthropic设计出长时智能体运行框架,让AI跨越数小时任务渐进式推进。其采用双智能体架构,结合环境管理方法,提升全栈Web应用开发稳定性,但仍有通用与多智能体架构选择等开放问题。

新智元