「LLM开发」共找到 2457 篇相关文章
小红书开源大模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……
小红书hi lab团队公布首个开源大模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度大,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。
小红书 AI 搜索负责人高龑确认出席 QCon 上海,分享小红书搜索的 LLM 进化之路
10月23 - 25日,QCon全球软件开发大会将在上海举办,聚焦多热门话题。小红书AI搜索负责人高龑将分享《从“搜内容”到“问AI”:小红书搜索的LLM进化之路》,介绍搜索实践及大模型应用经验。
开发速度不是瓶颈
文章围绕‘凭感觉编程’展开,指出开发速度并非产品成功的关键制约因素。分析原型与产品差异,以亚马逊、谷歌为例说明产品需不断尝试。强调真正瓶颈是验证和沟通,编码速度从来不是问题。
蚂蚁C2LLM:基于注意力池化的代码检索新范式
在Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,在MTEB - Code榜单表现出色,还得益于优质训练流程,成果已回馈社区。
Claude1.7万字系统提示词全网刷屏!Karpathy锐评:LLM训练缺乏关键范式
Claude近1.7万字系统提示词在GitHub泄露,网友称是提示技术的金矿。大神卡帕西提出系统提示学习新范式,模拟人类经验积累,让LLM有‘记忆’功能,引发网友激烈讨论。
我用1分钟开发了个上线应用,有阿里Meoo谁还学编程啊
阿里新出AI开发工具Meoo(秒悟),全程无需写代码,通过说话提需求,1分钟就能生成可上线、可分享、可交互的完整应用。它内置阿里云全家桶,能自动完成云服务环境搭建、数据库配置等,还支持创意社区和多人协作。
一位资深 Builder的自述:我如何借多 Agent 开发工作流,一周做出 MVP、一个月上线
资深Builder手工川分享开发经验,他99%代码由AI完成,认为需求、产品判断等比技术重要,爱生活易发现大众需求,还介绍了开发流程、多Agent协作难题及YODA开发工具等。
7.5K Star!HKUDS开源AI全栈开发框架,产品经理的Demo神器!
AI时代从论文到产品Demo开发全链路工作耗时费力,现有Agent也有诸多问题。香港大学数据科学实验室(HKUDS)开发的DeepCode开源框架,定位“全自动AI软件开发框架”,可一键从论文/需求生成完整项目,已获7.5K Star。
云厂商「进击」 Agent 开发平台
企业级智能体(Agent)市场崛起重构云服务竞争格局,云厂商需提供全栈能力。腾讯云宣布智能体开发平台3.0上线,优图实验室关键技术持续开源。文中还分析企业开发Agent难题及腾讯云应对举措。
推理时扰动高熵词,增强LLM性能
香港科技大学(广州)研究团队发现LLM推理时,一小部分高熵词显著影响输出正确性。基于此提出MTI方法,含Selective CFG intervention与Lightweight negative - prompt guidance,无需额外训练,能提升模型推理能力。