「插件机制」共找到 980 篇相关文章
一文解读 LLM Posting-Train技术
文章解读了大语言模型后训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。
本周推荐的5个超级6的Github开源项目!
本周推荐5个超棒的Github开源项目,有基于Nginx的可视化管理面板、全能型浏览器自动化框架、容器命令行版“任务管理器”、命令行知识管理工具,还有GitHub汉化浏览器插件,各有强大功能和特色。
10.6K star!再见了英文GitHub,这个汉化项目必须安排上,程序员力荐!
文章介绍实用开源项目`github-chinese`,它是GitHub界面汉化浏览器插件。由‘楼教主’开发、maboloshi维护,有开发版和发布版。有全面汉化等特色,还给出安装使用步骤,适合英文不好的新手。
刚刚,DeepMind通用科学智能体AlphaEvolve突破数学极限,陶哲轩合作参与
DeepMind发布革命性进化编码智能体AlphaEvolve,由LLMs驱动,可演化代码库、发现和优化算法。它结合LLM创造力与自动化评估,减少幻觉,在多领域应用前景大,还与陶哲轩合作探索数学应用。
「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!
本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。
一篇Self-Evolving Coding Agents最新综述
当今编码智能体部署后大多静止,自进化编码智能体应运而生,可让Agent通过交互更新自身。文章介绍了其概念、分类,探讨组件进化机制、时机及评估方法,也提及带来的新挑战。
kimi K3超大杯升级背后的技术内幕
文章介绍开源模型 K3 架构设计思路。主要探讨 MoE 和 MLA 部分,在 MoE 方面提出 SiTU、Norm、QB 改进;在注意力机制选择 MLA,与 KDA 混合缓解部分问题,还谈及 DSV4、NoPE 相关特点。
横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准超GPT-5.5 13.5%
清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。
一文搞懂如何在Codex中使用goals
OpenAI文章介绍Codex中Goals的使用,包括定义、使用方法、与普通prompt区别、编写要点、激活后变化、内部设计等,还给出复现论文示例,指出适用与不适用场景,称其改变Codex运作模式。
颠覆法律行业!Anthropic一口气发布20+款MCP连接器,从合同审查到法庭诉讼全覆盖
Anthropic面向法律行业推出超20款新MCP连接器及12个专业插件,从底层打通法律技术栈。Claude可在办公软件中工作,覆盖合同审查到法庭诉讼等场景,还与多机构合作让法律服务更普及。