「工具发现」共找到 2810 篇相关文章
一个App管好所有Agent技能,Chops来了
Chops是一款macOS应用,能自动发现所有AI coding agent的技能文件,支持Claude Code、Cursor等工具。功能丰富,技术栈纯粹,需macOS 15 Sequoia及以上,下载地址和文档在GitHub。
解密 Cursor:一位深度用户的原理探析与实验验证
文章作者作为 Cursor 付费用户,通过实验分析其与大模型通信机制和设计原理。用 OpenAI 的`gpt - 4o`模型做实验,发现它是‘基模 + 若干工具’组合,也指出在真实项目因上下文不足表现不佳。
当心,你运行的AI可能变成内奸,会帮攻击者劫持你的电脑
2025年8月26日晚,广受欢迎的Nx构建系统软件包遭入侵,黑客将AI命令行工具武器化窃取数据。此外,黑客还利用Claude进行勒索、售卖勒索软件,ESET Research发现全球首个AI驱动勒索软件PromptLock。
蓝湖悄咪咪在海外做了个 AI 设计产品,4 个月拿下 500w ARR
特工宇宙团队试用多款AI界面生成工具,发现多数距真实开发落地有差距。4月注意到Readdy.ai,操作简单、界面精致。其开发团队是蓝湖,上线4个月ARR达500万美元,解决用户真实问题。
不,AI 并没有让工程师的生产力提高 10 倍
作者 Colton Voege 分享自身经历,指出 AI 未让工程师生产力提升 10 倍。试用多种 AI 编程工具后,发现其有局限。从算笔账、分析 10 倍工程师等方面论证观点,还剖析鼓吹 AI 者的情况。
谷歌研究院探索多智能体协调的扩展原则
谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。
Anthropic最新研究:Claude存在神秘J空间,与人类心智高度相似
Anthropic研究团队在Claude中发现类似人类大脑工作机制的J空间,它存在于模型神经激活中,能让模型默默思考。失去J空间Claude在多步骤推理任务表现变差,还可暴露模型意图,团队已创建演示工具JLens。
推理能力大比拼,《推理模型综合测评报告 2025 》正式发布
过去半年,推理能力成大模型新分水岭。InfoQ研究中心评测八款热门模型,围绕五大维度,用超90%原创试题。发现各模型在不同维度表现有差异,推理模型发展正从‘一个大脑’变为‘带工具的多能智能体’。
谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分
纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师级水平差距明显。
人类造工具200万年,工具开始研究工具!97年天才少年带队,把“AI寻找研究方向”做成了现实
2026年AI开始研究AI(AI4AI),深圳EvoMap团队用蜂群协作做出产品EvoX。他们创新Agent组织方式,有实验数据支撑其效果,还开源成果AutoResearch解决AI痛点,在生活场景优化旧算法可行。