「五级能力论文」共找到 4002 篇相关文章
2026 编程巨变:Anthropic 报告揭示 Agent 编程八大趋势
Anthropic发布《2026 Agent编程趋势报告》,预测写代码将从‘人写’变为‘人指挥AI Agent写’。报告梳理八大趋势,分基础、能力、影响三类,还给出2026年需关注的领域,指出AI改变开发者工作内容。
揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷
近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法会进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这会影响训练,论文提出校正算法。
什么时候不该微调:比“怎么微调”更重要的一件事
文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。
LLM时代的事件抽取:从静态任务到认知脚手架
此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。
480万人围观的Claude code实战使用指南进阶来了:一文讲清Skill,子代理和MCP
Eyad发布Claude Code开发实战进阶篇,深入剖析其底层系统的Skills、Subagents和MCP connectors三大核心能力。通过对比,突出Claude Code在上下文窗口上的优势,还介绍了各功能用法及复合效应。
谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了
全球人工智能竞争升温,谷歌与 OpenAI 同日发布更新。谷歌推出全新 Gemini Deep Research 版本及嵌入式研究智能体 API,OpenAI 发布 GPT - 5.2。谷歌新工具能力提升,测试成绩佳,引发网友不同看法,二者竞争激烈。
比Qwen3-Max更Max?夸克抢先用上最新闭源模型
10月23日夸克上线对话助手,采用比Qwen3 - Max更优的Qwen最新闭源模型,实现AI搜索与对话深度融合。经测试其搜索、理解、写作等能力出色,技术架构创新,是阿里‘模型即应用’战略体现。
AI Agent已过时?OpenAI亮出王牌Deep Research!
浙江大学一篇综述论文《A Comprehensive Survey of Deep Research》系统性梳理了Deep Research赛道。它是一类AI系统,其背后的Agent范式可迁移到各场景,文章介绍了其技术、架构、应用及面临的挑战与未来方向。
The Batch:835 | 图表中的 AI 市场趋势
知名投资分析师 Mary Meeker 时隔六年发布 340 页 AI 市场报告。报告指出 AI 变革快、性能攀升、有新兴能力,还会影响劳动力等,同时也带来经济不确定性,当下是开发软件应用的黄金时期。
CAI+DeepSeek渗透测试情况及扩展分析
文章对CAI+DeepSeek进行渗透测试。介绍CAI安装,在kali按Ubuntu指令装,使用界面友好。测试中CAI执行指令彻底灵活,扫描分析到位。还提及CAI多种能力,称其作为开源框架全面细致,值得研究。