「大模型部署」共找到 9626 篇相关文章
告别玄学选LLM!弗吉尼亚理工选型框架入选ICML 2025
弗吉尼亚理工大学研究人员推出选型框架LensLLM,可预测微调后性能走势,解释大模型微调“玄学现象”。它基于全新PAC - Bayes泛化界限推导,降低成本近90%,被ICML 2025收录。
Agent面向结果交付,技术正从单点突破加速转向工程与系统竞争 |《中国软件技术发展洞察和趋势预测研究报告 2026》正式发布
2025 年技术热点不断,竞争重心从单点突破转向系统级等竞争。InfoQ 研究中心发布《中国软件技术发展洞察和趋势预测研究报告 2026》,盘点技术发展,还展望 2026 年十大技术趋势。
别再手写 Skill 了!微软最新研究:像神经网络一样训练 Skill
微软研究提出 SkillOpt 方法,把 Skill 文档当「权重」训练,在 52 个测试组合中全部最优或并列最优,平均提升 23.5 分,碾压人类手写。该方法跨模型、环境有效,已开源,使用方便。
火遍全网的AI在线生成前端页面DeepSite开源替代LocalSite
LocalSite AI是现代化网页应用,能按自然语言描述生成HTML、CSS和JavaScript代码。它功能丰富,支持多AI供应商,介绍了技术栈、安装步骤、部署方式、使用指南及发展路线等。
OpenAI「自首」!联手MIT证明:ChatGPT用得越多越孤独
OpenAI联合MIT进行四周随机对照实验,追踪981名受试者超30万条聊天消息。结果显示,ChatGPT用得越多,人越孤独,信任度越高伤害越深,语音模式长期副作用大,超120万用户心理亚健康。
Google 把翻译能力彻底开源了!TranslateGemma:550种语言通吃,还能直接看图翻译!
Google将多年积累的翻译能力灌进开源大模型TranslateGemma,它基于Gemma 3,专为翻译任务调优,有3个规模版本,覆盖550种语言,能直接看图翻译,亮点颇多。
英伟达,开始限制Claude使用了
本文援引The Information报道,英伟达、Palantir等大企业因对敏感数据控制权的顾虑,限制Anthropic Claude前沿模型用于核心敏感业务,探讨了企业级AI落地的新矛盾与行业发展方向。
GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026
近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。
4 天 6.8K Star,这个 AI 漫剧项目火了:waoowaoo!
短剧/漫剧市场火爆,但普通人制作门槛高。waoowaoo是solo开发者作品,4天6.8K Star。它能从小说文本一键生成视频,涵盖AI剧本分析、角色场景生成等功能,部署简单,技术栈主流。
把屁声发给ChatGPT,它说这是艺术
有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。