提示词操纵」共找到 544 篇相关文章

推荐文章7

从“写SQL”到“聊数据”:NL2SQL如何用自然语言解锁数据库?

文章阐述NL2SQL技术让非技术背景业务分析师自助查询数据,提升决策效率。介绍其定义、发展历程,剖析核心挑战与解决方案,如模式链接、复杂查询理解、提示工程等,还提及RAG等技术应用。

阿里云开发者
新闻资讯7

用隐藏指令诱导AI给论文打高分,谢赛宁合著论文被点名:认错,绝不鼓励

最近,一些简单提示在AI学术圈掀起风波,操作者将其隐秘嵌入论文诱导AI给高分。谢赛宁合著论文也涉此事,他紧急回应,承认过失,解释缘由并采取补救措施,还呼吁探讨AI时代科研伦理。

机器之心
算法论文7

ICLR 2026惊现SAM 3,分割一切的下一步:让模型理解「概念」

9月12日,匿名论文‘SAM 3: SEGMENT ANYTHING WITH CONCEPTS’登陆ICLR 2026,外界猜测出自Meta。SAM 3定义了可提示概念分割任务,性能比之前系统提升至少2倍,在多基准测试获SOTA成绩,但也有人质疑是旧概念包装。

机器之心
开源动态8

OpenClaw 背后核心框架 Pi:好的 Coding Agent 应该让用户来决定需要什么

OpenClaw 背后核心框架 Pi 是极简框架,系统提示和工具定义不到 1000 tokens。开发者 Mario 认为好的 coding agent 应让用户决定需求。Pi 不支持 MCP 等,在 Terminal Bench 2.0 排名靠前,GitHub 星数超 24000。

Founder Park
产品应用7

Kimi K2:唯一能稳定准确生成时钟的AI模型

AI World Clocks项目让9个大模型按提示生成每分钟更新的时钟,以观察稳定性。国产Kimi K2是唯一能稳定保持表盘与指针正确平滑转动的模型,测试显示了模型在时空概念上的能力差异。

AI工程化
推荐文章7

GLM-4.6 vs Claude 4.5:当AI编程模型能力趋同,会用比选什么更重要

文章对比GLM - 4.6和Claude 4.5在AI编程中的表现。用两套提示测试,发现二者能力接近,GLM - 4.6性价比高,还给出Claude Code + GLM - 4.6的组合使用方法,建议聚焦做产品而非纠结工具。

花叔
算法论文7

DeepSeek们越来越聪明,却也越来越不听话了。

论文《When Thinking Fails: The Pitfalls of Reasoning for Instruction - Following in LLMs》用实验验证,模型推理能力变强时,提示遵循能力变差。研究团队对15个模型测试,发现用CoT推理后执行准确率下降,还提出4种提升指令遵循效果的方案。

数字生命卡兹克
算法论文8

无需训练,如何提升黑箱VLM?CARPRT用「类别感知」给出答案

近年来,视觉 - 语言模型(VLMs)改变图像理解范式,但零样本分类性能对 Prompt 敏感。墨尔本大学 TMLR 小组提出 CARPRT 方案,以“无训练、黑箱适配、类别专属权重”解决提示语义适配不足问题,已被 ICLR 2026 接收。

机器之心
新闻资讯7

写在 Claude Design 发布之后:如果明天巨头做掉了你的核心功能,你该怎么办?

Anthropic 发布 Claude Design,可从提示生成设计稿等,让 Figma 市值蒸发。这引发对 AI 应用层产品的思考,当基础模型厂商收回能力,靠能力缺口的产品将失重,应用层需从工作流、数据等找机会。

AI科技大本营
开源动态7

写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾?

libGDX 创始人、17 年开源老兵 Mario Zechner 吐槽 Claude Code、OpenCode 等工具功能堆叠,带来掌控感丧失等问题。他推出极简主义编程 agent pi,仅含四种工具,有最短系统提示,扩展性强,能让开发者重拾掌控权。

InfoQ