「参数高效微调」共找到 1419 篇相关文章
从输入指令到代码落地:Cline AI 源码浅析
文章从源码角度剖析 Cline AI 将自然语言指令转化为编程任务的过程,包括启动调试、前端输入、主进程处理、任务初始化、构建提示、模型请求等环节,指出核心是 prompt 组装和 tools 调用。
文本分类重大创新:持续学习新增类别,不会灾难遗忘
在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类器,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。
超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
推理时间减少70%!前馈3DGS「压缩神器」来了,浙大Monash联合出品
在AR、VR等领域,3DGS是新视角合成(NVS)领域备受关注的技术方案。现有前馈3DGS模型存在编码器容量有限等问题,ZIP Lab和Monash团队引入信息瓶颈原理,推出轻量级模块ZPressor,有效解决信息过载难题。
DeepSeek接入智慧小浪,「评论罗伯特」爆梗进化!背后大模型全揭秘
新浪新闻推出AI辅助工具「智慧小浪」,接入DeepSeek深度思考能力,依托知微大模型,能总结资讯要点、提供延伸阅读。微博「评论罗伯特」升级,更懂用户情绪、回复有深度。此外,微博还有博主AI助手等爆款应用。
大模型智能体如何突破规模化应用瓶颈,核心在于Agentic ROI
上海交通大学联合中科大研究指出,大模型智能体规模化应用有瓶颈,核心在于Agentic ROI 未达实用门槛。研究提出其发展呈「之字形」,先规模提升信息质量,再轻量化降成本。
快速理解热门LLM大语言模型
本文用通俗易懂方式帮读者理解LLM、Transformer、Prompt等基本概念,介绍大模型API使用,如温度参数、角色设定等,还提及Function Calling、Agent、MCP等内容,并对AI未来发展作出假想。
OpenAI推出云端编程智能体Codex,进一步推动软件工程领域变革
OpenAI昨夜发布研究预览版Codex,一款集成在ChatGPT中的高级编码智能助理。它基于codex - 1模型,支持多种编程语言,有深度代码分析等核心功能,还有codex - mini - latest API版本,或重构软件开发行业。
编程革命彻底爆发!刚刚,OpenAI最强智能体上线ChatGPT
OpenAI发布云端AI编程智能体Codex,由codex - 1加持,多任务并行,半小时可干完数天软件工程任务。它能完成多项编程任务,还与GitHub集成。已向部分ChatGPT用户开放,Codex CLI也有更新。
社交Agent: 通过RL学习自适应Thinking,根据场景在“秒回”和“深思”间灵活切换
现有聊天机器人在人情世故场景表现不佳,论文指出大模型思维‘一根筋’。研究团队设计4种思维模式,用AMPO强化学习算法动态切换。在模拟社交任务中,AMPO表现超GPT - 4,省时高效。