「代码模型」共找到 8636 篇相关文章
揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜
近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。
一举击败Claude Code!微软提出代码生成黑科技:一键直出36K行代码
现有方法依赖自然语言规划生成仓库易失效,微软提出Repository Planning Graph (RPG),以图谱替代文字规划。基于此的ZeroRepo框架能让仓库生成可控、可扩、可验证,在新基准RepoCraft上表现远超Claude Code。
推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理
ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。
在Claude桌面版里用任意模型
现在Claude桌面版可使用任意模型,这是4月官方更新添加开发者模式带来的功能。文中介绍了操作方法,还称Claude桌面版是世界最好的AI客户端,覆盖多种使用场景,推荐大家使用。
刚刚,OpenAI开源了两个大模型~
OpenAI开源基于GPT - OSS的安全推理模型GPT - OSS - Safeguard - 120B和GPT - OSS - Safeguard - 20B,用于安全用例。有安全推理训练、自带策略等亮点,适配不同显存,采用宽松许可证。
OpenAI即将发布:开源模型和浏览器
OpenAI将发布AI驱动的网页浏览器挑战谷歌Chrome,或集成代理Operator实现智能网络体验。还准备下周四发布类似o3 mini的开源模型,不再是微软Azure独家。谷歌也可能很快发布Gemini 3。
快速理解热门LLM大语言模型
本文用通俗易懂方式帮读者理解LLM、Transformer、Prompt等基本概念,介绍大模型API使用,如温度参数、角色设定等,还提及Function Calling、Agent、MCP等内容,并对AI未来发展作出假想。
Life of a Token:像调试代码一样看懂大模型如何生成 Token
文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。
代码怎么才能跑的更快
文章围绕让代码跑更快展开,先介绍调整源代码的方法,如降低循环开销、去除内存引用等,又阐述使用硬件加速指令,像用 SIMD 函数、避免分支语句等,还提及多核并行和分析瓶颈等要点。
世界模型混战,蚂蚁炸出开源牌
蚂蚁集团旗下蚂蚁灵波发布并开源通用世界模型 LingBot-World,全面开源代码和权重,不绑定硬件或平台。它在多维度有突破,虽有细节瑕疵,但单次生成近 10 分钟连贯视频或刷新纪录,还在 VBench 测试领先。