「产品与服务」共找到 7972 篇相关文章
阿里Qwen3技术报告核心要点解读!
阿里Qwen3技术报告发布,披露模型架构、预训练及后训练等技术细节。其有密集与混合专家两种模型架构,预训练数据量和语种增多,后训练采用强到弱蒸馏提升性能,各模型表现优异。
SGLang Team:在 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行性的 DeepSeek
本文介绍 SGLang 团队在 96 个 H100 GPU 上部署 DeepSeek 的方法。利用 PD 分解和大规模专家并行性,SGLang 实现高吞吐量,成本低。博客探讨并行设计、优化方法,所有组件开源,也指出了当前局限与未来方向。
GPT-4o图像生成的「核燃料」找到了!万字长文拆解潜在变量,网友:原来AI在另一个维度作画
上月,GPT - 4o图像生成功能爆火。Sander Dielman在博客中探讨生成模型利用潜在空间提高效率和质量,将潜在变量比作「数据精髓」,深入对比多种模型,还介绍训练方法、损失函数等,兼具理论深度与直观洞察。
Anthropic这回撒钱了!Claude Code最高白送250美元
本文报道Anthropic推出正式版Claude Code云端会话功能,为符合条件的老用户发放最高250美元免费赠额,推广云端离线跑代码新能力,介绍了活动规则、功能特点及业内讨论。
90后CEO执掌钉钉103天:迎战AI办公,先卸下12年的“历史包袱”
本文聚焦90后CEO陈宇森执掌钉钉103天后的首份答卷,探讨AI办公时代,拥有12年历史的钉钉如何卸下功能叠加包袱,推出千问办公探索企业级Agent的破局路径,融合客户采访与行业分析。
独家|撬开Jev黑箱,对话全球首批复现者:9B小模型跑通79毫秒“快决策”
本文独家对话APUS AI首席科学家张旭,该团队完成全球首批爆火Jev模型的功能复现,开源相关成果,实现9B小模型79毫秒单次决策,拆解Jev底层逻辑,探讨快决策模型应用前景与Agent未来分工趋势。
我给阶跃星辰 Step 5 Preview 出了一道工程题
本文作者池建强参与阶跃星辰新一代旗舰大模型Step 5 Preview小范围内测,设置带两层bug和隐藏需求的编码工程题,与Qwen 3.8 Max、Kimi K3对比测试,分享实际项目使用体验,给出客观评测。
基于 Qwen3.8-Max 构建 AI 合同精审系统:文档解析、多轮条款分析 Pipeline 工程实战
本文分享基于Qwen3.8-Max大模型+Python Flask搭建AI合同精审系统的完整工程实战,包含环境配置、项目架构、核心模块开发,记录开发踩坑经验,附AI与人工审查的实测对比数据,适合中小企业合同初审使用。
给企业当“AI管家”,以色列初创一年估值50亿
当地时间9月2日,荷兰AI初创公司Wonderful完成5.5亿美元C轮融资,估值达50亿。其提供AI操作系统,让不同AI共享数据、协作。它解决企业多智能体协同难题,产品已在以色列医疗保健机构取得良好效果。
全网实测开玩Fable 5.1,听说写作说话和真人没区别?
Anthropic发布Fable 5.1后,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every全面测评,指出其多方面优势与设计等短板,并给出使用边界。