「行为分类」共找到 370 篇相关文章
Google情报报告:滥用 AI 工具的最新进展
谷歌威胁情报小组(GTIG)报告显示,2025年攻击者将新型AI恶意软件用于实际攻击,恶意软件采用即时AI、利用社会工程绕过防护,AI工具网络犯罪市场成熟,如PROMPTFLUX等利用AI动态改变行为。
大模型自信心崩塌!谷歌DeepMind证实:反对意见让GPT-4o轻易放弃正确答案
谷歌DeepMind携手伦敦大学研究发现,GPT - 4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为,原因与训练、决策逻辑、记忆机制有关。研究还通过两轮实验证实。
刚刚,DeepSeek陈德里与两个AI,合写了一篇论文
DeepSeek研究员陈德里与DeepSeek-V4-Pro、GPT - Image2合写论文《From Copilots to Colleagues: A Survey of Autonomous Research Agents》。文章是兴趣驱动的尝试,分析自主科研智能体,提出自主等级分类、架构模式分析及未解难题。
从 Prompt 到 Context:基于 1400+ 论文的 Context Engineering 系统综述
本文围绕Context Engineering展开,介绍其定义、与Prompt Engineering区别,从LLM OS视角说明其重要性,指出context处理不当的问题,对其分类及处理管理过程进行探讨,还提及面向LLM Context开发的变化。
为什么Agent总是Demo猛如龙实战一条虫?
一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。
复盘高德扫街榜100天
2026年1月7日,高德发布“高德扫街榜2026”新版本,有三大升级。上线百日成绩亮眼,累计用户超6.6亿。它在异地场景优势明显,还打出“行为数据”王牌,从多层面解决信任问题,推出飞行街景等功能。
Anthropic最新论文:检测LLM内省意识的方法
Anthropic与MIT等研究表明,LLM能‘感知’被注入的steering vector,‘内省意识’在DPO等后训练阶段涌现。研究构建实验,发现内省能力行为稳健、检测非简单线性关联等,还揭示检测与识别机制不同及两阶段电路。
综述连arXiv都不给发了?最严新规出台:被会议、期刊接收才行,workshop都不行
arXiv出台新规,计算机科学分类下综述和立场论文须先被正式期刊或会议接收且完成同行评审,投稿时要提供证据。因此类文章数量多、质量差,新规引发热议,有人认为太严。
ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术
清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。
研究者警告:强化学习暗藏「策略悬崖」危机,AI对齐的根本性挑战浮现
强化学习是大模型推理与对齐的核心方法,但常带来模型行为脆弱等问题。上海人工智能实验室徐兴成博士论文揭示‘策略悬崖’挑战,分析其成因,解释多种对齐失败现象,并提出对AI研究的启示。