「Llama 3.1」共找到 3432 篇相关文章
92亿美元创纪录营收背后,AMD从英伟达手中“抢”走了什么?|甲子光年
美国当地时间11月4日,AMD公布2025财年第三季度财报,多项数据创纪录,已悄然抢夺英伟达在AI领域市场。其崛起基于GPU、CPU及软件层面战略部署,在中国市场也有独特策略,但转型仍面临风险。
英特尔:止亏回血!“美式中芯”能挖角台积电吗?
英特尔2025年第三季度财报显示,营收136.5亿美元,毛利率回升。公司裁员控费,员工总数将减至7.5万。主要收入来自客户端和数据中心及AI业务。18A工艺量产,虽落后台积电,但给市场追赶信心,代工业务或成突破口。
SGLang 优化Triton FusedMoE 的一个新技巧
蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。
中际旭创的高增长,还能持续多久?
今年夏季光模块龙头中际旭创市场表现强劲,市值逼近4600亿,但控股股东计划减持。此前也有股东减持,市场曾争论其估值合理性。要实现250亿利润目标,受北美大厂算力支出、竞争、CPO进展等因素影响。
蚂蚁dInfer框架,让扩散大语言模型推理速度再飙10倍,相同模型性能下超越自回归模型
蚂蚁开源dInfer框架,联合名校发论文阐述实现细节。它解决扩散模型推理难题,提出创新算法和系统优化策略,实验显示其推理速度远超Fast - dLLM和自回归模型标杆vLLM,代码已开源。
GPT-6或将比GPT-5强10倍!奥特曼揭秘ChatGPT如何诞生
奥特曼在访谈中表示ChatGPT从1到10的艰难已过,未来从10到100或更易。他还探讨AI变革、企业洗牌、工作替代等问题,揭秘ChatGPT诞生过程,阐述OpenAI愿景及AI普惠方案。
讲习班日程公布|第四届全国大模型智能生成大会(LMG 2025)
第四届全国大模型智能生成大会(LMG 2025)11月1 - 3日在成都召开,预计超千人参会。11月3日的讲习班邀请四位青年专家,围绕AI基础设施、扩散语言模型等前沿议题,分享技术进展与实战经验。
6.6K Star 打破次元壁!MCP-Use开源爆火:6行代码让LLM操控万物!
在AI Agent开发热潮中,MCP-Use作为开源Python库爆火。它用6行代码让LLM操控万物,支持多模型、多服务器,提供安全机制,适配网页浏览、3D建模等多种场景,降低AI Agent开发门槛。
甲小姐对话黄伟:一边“找死”,一边活下去 | 甲子光年
云知声创始人黄伟创业13年、筹备上市5年,其经历反映中国AI企业生存真相。他分享云知声上市波折、战略选择、应对竞争策略等,如在‘等死’与‘找死’间抉择,认为市场分散利于创业公司,AI 2.0竞争更激烈。
ART:构建可靠智能体的强化学习新框架
现有AI智能体在真实场景表现不稳定,阻碍其应用走向生产。ART开源强化学习框架诞生,通过分离“前端”与“后端”、兼容OpenAI推理端点等创新化解困境,还给出使用方法,在案例中展现强大效能与经济性。