「跨平台迁移」共找到 1780 篇相关文章
神秘模型「Pony Alpha」引外网热议,它会是国产大模型中的谁?
近日,全球模型服务平台OpenRouter上搜索第一的神秘模型「Pony Alpha」引外网热议,它是新一代通用大模型,在多方面表现突出且可免费使用。网友、AI猜测其身份众说纷纭,已有人用它做出惊艳案例。
数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?
论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。
AICon上海演讲精华回顾:《GMI Cloud 全球化高性能分布式推理服务构建实践》
AICon2025上海站,GMI Cloud资深架构师Frank Lee分享《GMI Cloud全球化高性能分布式推理服务构建实践》,介绍其推理平台,拆解扩缩容等能力,分享架构设计、部署及优化实践,揭秘推理提效关键路径。
深入解析|Cursor编程实践经验分享
文章结合近两个月实践,分享Cursor编程经验,探讨其适用场景与问题。介绍使用方法,如标准Prompt、Rules等,还提及MCP工具及Cursor不足,对比DeepResearch等平台,最后介绍AutoGPT、Claude4.0等技术。
华为昇腾推理对决:开源vLLM vs 官方MindIE,数据说话「Qwen与DeepSeek推理实测」
文章围绕华为昇腾推理,对比开源vLLM与官方MindIE。借助GPUStack平台测试Qwen与DeepSeek模型,分析不同场景性能。指出vLLM和MindIE各有优势,还强调构建国产AI推理生态需多要素,鼓励开源协作。
大模型微调知识与实践分享
文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。
Agent群体智能来了!魔搭开源Agent自进化群体智能框架:群体记忆自动蒸馏与进化,8万+群体技能即取即用,智能体画像一键复用
个人或团队部署使用智能体面临状态易失、重复试错、迁移困难等痛点。魔搭ModelScope团队开源的Ultron框架,补上群体协作基础设施,解决经验沉淀、技能进化和画像共享问题,提升智能体协作效率。
打破学科壁垒!400篇参考文献重磅综述,统一调查「人脑×Agent」记忆系统
哈工大等多机构联合发布重磅综述,打破认知神经科学与人工智能学科壁垒,统一审视人脑与 Agent 记忆系统。文中剖析记忆定义、作用、分类、存储、管理等,还提及评测、安全问题及未来多模态记忆、技能迁移方向。
英伟达XR-AI Scientist亮相:丛乐、王梦迪团队把“AI科学家”送进实验室|甲子光年
10月底英伟达上线NVIDIA XR - AI平台,丛乐、王梦迪团队联合英伟达等推进其在实验室科学融合应用,涉及LabOS和CRISPR - GPT两项技术突破,还推出LSV Benchmark标准及排行榜,有望改变XR现状。
医疗AI质变时刻来临!国产医疗AI率先突破,临床诊疗能力问鼎全球
文章指出当前医疗AI真实能力与临床期待有落差,为此中国医生联合制定全球首个评估医疗AI临床适用性标准,完成对主流模型测评,中国企业打造的MedGPT夺冠,还推出‘未来医生’平台服务患者。