「从零训练」共找到 4880 篇相关文章
从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据
文档视觉编码器对LLM理解和推理很重要。MonkeyOCRv2提出‘重建即文档视觉记忆’,通过多组实验验证其有效性,还发布MonkeyDoc v2数据集,推动公平比较的研究文化。
从3632个漏洞看AI时代的评测基准重构!VulnGym基准发布
随着新一代漏洞检测工具出现,漏洞检测走向理解业务风险。腾讯悟空安全团队联合多机构发布 VulnGym 评测基准,基于真实漏洞构建,覆盖 400+ 漏洞路径,71.2% 为业务逻辑漏洞,支持确定性评测。
Karpathy公开附议:AI Agent 的输出格式,正在从 Markdown 走向 HTML
随着 Agent 处理任务变复杂,Markdown 在长文档中可读性与排版局限凸显。HTML 能无损表达信息、支持双向交互,但生成耗时久、版本控制难。AI 研究者 Karpathy 附议,HTML 成探索方向。
openJiuwen社区首发「Coordination Enginnering」,让智能体从「单兵作战」到「精锐团队」
openJiuwen社区围绕Coordination Engineering发布多智能体协同技术体系,包括Agent Team、Team Skills等。该体系解决多智能体协作问题,实现团队自主协作、经验沉淀与进化,还提供相关工具和平台。
Claude Code 最佳实践:从「能用」到「用得好」的 15 个关键技巧
GitHub热门仓库‘claude - code - best - practice’拆透Claude Code用法。本文提炼其精华,结合经验给出实操指南,涵盖上下文管理、CLAUDE.md设置、子代理等15个关键技巧,助你用好Claude Code。
从0开始,在国内用上Claude Code的终极保姆教程来了。
作者应朋友要求,推出Claude Code小白教程。介绍其为优质Agent框架,适配多种模型,国内使用不封号。详细讲解Mac和Windows系统下的安装、接模型、启动步骤,还提及CLAUDE.md文件设置。
让离线强化学习从「局部描摹」变「全局布局」丨ICLR'26
现有生成式离线强化学习方法在复杂连续任务长程规划中易陷入局部合理但全局偏航的窘境。厦门大学和香港科技大学提出MAGE算法,采用自顶向下策略,实验显示其多任务表现出色、推理效率高。
Harness Engineering 的防御视角:从 Codex Security 看 AI 生成代码的治理
作者用 Codex Security 分析项目,发现它不仅列漏洞,还提供攻击路径等。AI 没创造新漏洞,却放大缺陷,需新方式治理大规模自动生成代码,Harness Engineering 有防御价值。
从“暴力烧Token”到“系统工程”:OpenAI与华为的两条 AI 编程路径
文章对比OpenAI与华为的AI编程路径,指出模型中心派靠推高上下文窗口但有成本高、延迟大等问题;工具驱动派如Cursor和华为云码道重构IDE工具。码道将任务解耦,通过多技术实现性价比,还介绍了底层基石及其实测表现。
Qwen3.5实战教程:从0到1掌握本地部署与微调
阿里通义千问团队发布Qwen3.5系列小模型,打破“大模型=高成本”惯例。本文全面剖析该系列模型,涵盖核心特性、本地部署实战、模型微调实战,还给出技术细节与问题解决办法。