「LLM越狱算法」共找到 1493 篇相关文章
11.4K Star!基于 AI 大神 Karpathy 的编程经验开源的 Claude Code 技能插件。
AI写代码常遇盲目假设、过度设计、乱改代码等问题。开发者把AI大神Andrej Karpathy经验总结成Claude Code插件andrej - karpathy - skills,设定四大原则,还介绍使用、验证及自定义方法。
AI时代已来,魔幻的大模型投毒事件,我们怎么应对?
央视315晚会曝光针对大模型的蓄意信息围猎,虚构手环经力擎系统包装成科技尖货。黑产靠此吸金,利用技术污染证据链。多方已行动,厂商需提升安全能力,消费者要保持警惕。
JustGRPO:扩散语言模型的极简主义回归
本文提出回归极简的方法 JustGRPO,在 RL 阶段让模型自回归生成,用标准 GRPO 训练,能超越各类针对 dLLM 设计的 RL 算法表现,提升推理表现同时保留并行解码能力。
斯坦福×英伟达发布AI推理新范式,刷新了多领域SOTA
斯坦福与英伟达联合发布论文 TTT - Discover,提出新范式,不追求通用,在推理阶段针对特定难题修改模型参数。它战绩辉煌,但成本高、是偏科生且需打分器,其出现是技术与哲学的突破。
如何让AI“看懂”网页?拆解 Browser-Use 的三大核心技术模块
传统Browser - Use难应对界面变化,大模型驱动下正迈向智能化。文章拆解其三大核心技术模块,介绍历史发展、核心功能,分析源码各模块,指出创新点与不足,还提及业界更好解决方案。
2025中国力学大会AI+分享 | 国防科技大学刘杰研究员:AI赋能PDE全流程求解
在2025中国力学大会AI+分享中,国防科技大学刘杰研究员介绍AI赋能PDE全流程求解。刘杰是研究员、博导,在并行算法等领域成果颇丰,主持多项项目,获多个奖项。
这篇超有用!手把手教你搭建 AI 产品 Evals
文章指出AI下半场模型评估比训练更重要,做好Evals是当下AI产品开发刚需。介绍了Evals重要性、三种方法、通用评估标准等,还教你从零构建Evals及设计注意事项,助你快速上手评估。
当智能成为主要生产资料,硅基经济学引爆「AI+金融」
华东师范大学上海人工智能金融学院院长邵怡蕾提出「硅基经济学」,它以人工智能等为生产资料与经济驱动核心。她还介绍了SAIFS金融智能引擎,认为AI应创造经济价值,提出硅基世界“权力三角形”等观点。
太酷了!Anthropic 让Claude 开了家店赚钱,却被员工狂薅羊毛,亏到破产……
Anthropic让Claude Sonnet 3.7在办公室经营小店,配备网络搜索等工具。Claude因定价失误、好说话等致亏本破产,不过也展现出搜索和适应能力。Anthropic认为AI成中层管理者不远,改进后或不亏本。
集GraphRAG 和 DeepSearch于一体的智能问答系统graph-rag-agent
本项目结合GraphRAG与私域Deep Search,实现可解释、可推理的智能问答系统。亮点有从零复现GraphRAG、创新融合DeepSearch等,具备多模块功能,还有简单演示,地址https://github.com/1517005260/graph-rag-agent/blob/master/readme.md。