代码大模型」共找到 9950 篇相关文章

算法论文8

ACL 2025 | 清华&港中文提出 MorphMark:全新理论视角破解模型水印效力与文本质量的两难困境

随着模型广泛应用,AI 生成内容追溯和版权保护成问题,现有水印技术面临效力与文本质量的矛盾。清华和港中文团队提出 MorphMark 自适应水印框架,动态调强度,在多模型实验中表现优。

深度学习自然语言处理
新闻资讯7

模型低价趋势延续!智象未来姚霆:B端、C端界限模糊,API不够、逼出 “按结果付费”

InfoQ 采访智象未来联合创始人姚霆,探讨多模态模型发展。他指出深度 Scaling up 收益放缓,广度 Scaling up 有惊喜;2025 年模型价格战倒逼厂商加速,低价趋势 2026 年将延续,商业模式转向“按结果付费”。

InfoQ
算法论文8

Agent也能蒸馏了!性能超好

模型运行成本高,普通用户用不起。传统小模型模仿模型解题步骤易出错。论文提出Agent蒸馏,让小模型学会用检索和代码工具,还加首思前缀与自我纠错“外挂”,使小模型性能直逼模型

深度学习自然语言处理
算法论文8

训练提速4.6倍!FP4+BF16双轨并行,NVIDIA×港×MIT联手重新定义扩散模型训练速度上限

NVIDIA、港、MIT团队提出Sol - RL,采用「FP4先探索、BF16再训练」框架,将扩散模型训练收敛速度最高提至4.64x,在速度与对齐效果间给出工程可行解法。

机器之心
算法论文8

斯坦福提出新的RL范式,让3B模型的Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两挑战,为AI代理发展指明方向。

深度学习自然语言处理
算法论文8

模型「持续注入新知识」,北航CASE框架:编辑千次不失忆,额外参数不到1MB丨WWW'26

北航团队提出CASE框架解决语言模型持续吸收新知识难题。该框架给编辑“算分”、调“关键神经元”,破解核心痛点。实验显示,1000次编辑后准确率提升近10%,额外参数不到1MB。

量子位
开源动态8

GitHub 23.6k star 的 BMAD Method:如何把模型系统提示词,变成一支“可复制的 AI 开发团队”?

BMAD Method是开源的AI驱动敏捷开发方法论与工具集,基于BMAD Core框架,有19个专业AI角色和50+条工作流,获23.6k颗GitHub Star。它解决了模型使用痛点,将AI开发工程化,可在多工具复用。

小华同学ai
开源动态7

Distilabel DeepSeek-R1 模型蒸馏教程

文章介绍结合distilabel与QLoRA技术定制专属模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。

机器学习AI算法工程
算法论文8

因果发现模型迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116

、清华与稳准智能联合发布因果发现模型DAG - FM,解决了现有模型缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
开源动态7

你那上万行Agent代码都是垃圾!Browser Use作者骑脸输出,开源了Manus级内核。

Browser Use作者Gregor Zunic称上万行Agent代码是垃圾,提前开源驱动BU.app的Agent内核。其核心仅一个for循环,理念是价值在模型代码,还介绍三支柱,使用方便,项目道至简。

探索AGI