微调代码」共找到 1896 篇相关文章

推荐文章7

Harness Engineering 为什么是 Agent 时代的“控制论”?

本文是 George Zhang 对 Harness engineering 的解读。OpenAI 提出新工作方式,让 agent 编码,引发讨论。从瓦特调速器到 Kubernetes 再到如今的 harness engineering,本质都是控制论模式。LLM 或使代码库反馈回路在关键决策层闭合,但校准传感器和执行器是难题。

海外独角兽
开源动态7

Container Use:一种用于独立的并行编码代理的新工具

Dagger团队发布开源工具Container Use,为AI编码代理提供容器化沙箱和Git工作树,实现无冲突并行工作流。它能创建隔离开发环境,让开发者在同一代码库安全运行多代理。不过该工具尚处早期,有不足。此外还介绍了其他类似工具。

InfoQ
开源动态8

超越英伟达Describe Anything!中科院 & 字节联合提出「GAR」,为DeepSeek-OCR添砖加瓦

中科院与字节联合提出「GAR」,为构建自然图像的Dense Caption提供新思路。GAR具备精准描述、关系建模和组合推理能力,通过引入新组件,兼顾细粒度与全局上下文,在多测试集表现优异,且代码等已开源。

量子位
新闻资讯7

OpenAI 的“编程”新范式?其实是瀑布模型的回魂:“听 PM 的话、写需求文档”

在今年AI工程师大会上,OpenAI研究员Sean Grove提出在AI驱动时代,清晰规范将取代传统代码成软件开发核心产物。他认为编程核心是结构化沟通,该转变是工程实践未来方向,但引发诸多讨论。

InfoQ
产品应用7

混元 Hy3 发布:99% 的任务,够用了

腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了多项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。

AGI Hunt
算法论文8

这些大神在Meta的论文看一篇少一篇了

田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。

量子位
产品应用8

聚焦手机AI“超级入口”,中兴Nebula小模型让手机秒变“小秘”?

移动智能时代,手机AI“超级入口”成竞争焦点。美团率先推出AI Agent,中兴通讯自研Nebula-GUI模型表现亮眼,在测评中获佳绩,已在多款手机商用,还开发数据制备系统,经监督微调、双层强化学习提升性能。

量子位
开源动态8

碾压DeepSeek V3!阿里开源新版Qwen-3,屠榜级断层第一

今天凌晨1点,阿里巴巴开源Qwen3系列新版本Qwen3 - 235B - A22B - 2507。它是非思维推理的指令微调模型,性能强劲,在多类测试基准中大幅超DeepSeek开源的新版V3 - 0324及月之暗面的kimi - k2。

AIGC开放社区
新闻资讯8

Cursor 套壳、Cloudflare 上架、老黄邀请,中国模型杀进了硅谷的 AI 供应链

3月19日,Cursor发布新模型Composer 2,后被发现底层基于中国Kimi开源模型K2.5微调。此外,Cloudflare将K2.5上架到边缘计算平台,成本降77%;黄仁勋邀Kimi创始人演讲;马斯克两度点赞Kimi。

Founder Park
开源动态8

不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍

英伟达联合多机构推出TTT - E2E方法,在长文本处理上提速显著且性能不打折。它基于标准Transformer,将长文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。

量子位