「离线AI大模型」共找到 13544 篇相关文章
Distilabel DeepSeek-R1 模型蒸馏教程
文章介绍结合distilabel与QLoRA技术定制专属大模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。
奶牛版 Oura 估值 10 亿美金,AI+PDF 让它拿了 1700 万美金融资
市场上多数AI PDF产品是ChatPDF模式,用于C端。企业关键非结构化数据多在PDF等传统载体中,难以获取。硅谷工程师做的Extend AI产品,获1700万美金融资,解决传统文档处理难题,打造平台。
阿里云CIO首次系统复盘:大模型落地的RIDE方法论与RaaS实践突破
阿里云智能集团 CIO 蒋林泉分享大模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。
Anthropic史诗级泄密!全新模型意外曝光:能力碾压Opus 4.6,因太危险被限制发布
Anthropic重大泄密,全新模型“克劳德神话”(Claude Mythos)及Capybara层级曝光。新模型性能超Claude Opus 4.6,但因网络安全隐患大未全面发布,首批仅给安全机构。泄密源于配置失误。
OpenAI 的“编程”新范式?其实是瀑布模型的回魂:“听 PM 的话、写需求文档”
在AI工程师大会上,OpenAI研究员Sean Grove提出“规范驱动开发”,认为清晰规范将取代代码成软件开发核心。此观点引发讨论,有人认同,有人反对,也代表了AI编程从“造轮子”到“定方向”的转折。
高考第一天,用豆包修图3.0花式「整活」送祝福,已原地笑翻!
豆包的一句话P图功能进化,其图像编辑模型SeedEdit 3.0全量上线,AI修图进入3.0时代。用自然语言就能精准编辑图片,在文字编辑、局部修改等方面表现出色,还突破以往模型瓶颈,成设计师利器。
卷赢OpenAI也没用!Salesforce用100万次对话揭秘:AI Agent最大的坑,根本不是技术!
Salesforce处理超100万次AI Agent与客户对话后复盘,指出行业追求“全自动化”是陷阱。AI Agent不仅要融合非结构化和结构化数据,还需提升人工介入率,遵循“同理心优先”原则。
AI for Health:从「实验室Demo」到「国民级健康伙伴」的范式跃迁 | GAIR Live 024期预告
医疗大模型正从“聊天工具”进化为“生命基础设施”,但面临诸多挑战。GAIR Live 024期圆桌将汇聚学术与产业顶尖智慧,探讨构建可信、高效、人机协同的医疗新范式,剖析核心议题,分享讨论精华。
2025 AI Cloud 100 China榜单发布:6个赛道,34家新上榜,DeepSeek、Manus上榜
6月22日,靖亚资本等发布2025 AI Cloud 100 China榜单,聚焦GenAI商业落地企业。还发布行业趋势报告,总结融资、技术等情况,预测未来五大趋势,如AI应用从Copilot升级到Autopilot等。
AI视频生成走向“演技生成”时代,生数科技Vidu全球发布Vidu Q2 | 甲子光年
9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,实现从“视频生成”到“演技生成”跨越。它在表情生成、运镜、语义理解、时长选择等方面有提升,分闪电和大片模式,已在多端上线。