「指令检测」共找到 456 篇相关文章
Anthropic 发布最新研究:LLM 展现初步自省迹象
Anthropic 最新研究表明,Claude 展现出真实但有限的内省能力,能在某种程度上识别自己内部状态。研究团队开发验证方法,通过概念注入等实验进行测试,还发现认知控制证据等,不过该能力有局限。
ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节
格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。
刚刚,Anthropic 发布首个美国 AI 经济指数报告。结论:越有钱的,用得越多!
Anthropic发布首份美国AI经济指数报告,发现人们将完整任务交给Claude比例大幅上升,各地AI使用受经济结构影响,GDP高的国家和地区使用率更高,且自动化使用占比上升。
炸裂黑科技,脑波沟通来了!AlterEgo让你在大脑中发声
AlterEgo是一种非侵入式、可穿戴的外围神经接口,能让人用自然语言与机器等交流,无需发声。它始于2018年MIT媒体实验室,2025年初独立运营,可用于帮助语言障碍者,还能融入日常生活。
Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!
Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持多主流大模型。有多智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。
OpenAI官方GPT-5 提示词泄露:这套“反向Prompt”技巧,让模型听话得像条狗。
GPT5提示词被破解,结合官方《GPT - 5 Prompting Guide》有不少技巧。如Metaprompting让GPT - 5优化Prompt,指导AI编码可明确知识、培养自信等,还有控制AI主动性的方法。
首篇WebAgents综述:大模型赋能AI Agent,实现下一代Web自动化
互联网任务重复繁琐,香港理工大学研究人员从架构、训练和可信性等角度,总结WebAgents代表性方法,梳理研究进展。WebAgents能根据用户指令完成网页任务,其发展预示人机关系新纪元。
MCP协议曝出大漏洞:会泄露整个数据库
最新研究显示,MCP协议存在重大漏洞,攻击者可利用LLM的指令/数据混淆漏洞直接访问数据库。研究者基于Supabase搭建系统演示攻击过程,还给出降低风险的解决措施。
DeepMind华人研究员Lun Wang离职,「评估」成制约模型能力飞跃的瓶颈
谷歌DeepMind研究员Lun Wang离职后发文指出,当下评估体系难以应对新模型,制约模型能力飞跃。现有评估多针对当前模型,新能力出现时往往无法预测,需构建能自我进化的评估系统。
AI Agents的DeepSeek顿悟时刻:AutoHarness
文章介绍开源项目「Aha」— AutoHarness,这是面向AI Agent的自动化Harness Engineering轻量级治理框架,能让智能体迎来顿悟时刻。对比了其与LangGraph、OpenAI SDK能力,还给出核心架构、安装及使用示例。