「工单分析」共找到 1624 篇相关文章
传言称:Llama 4 团队80%成员集体辞职!
有爆料称Meta的Llama 4团队约80%成员集体辞职,引发AI圈关注。但Meta员工澄清该消息不准确,且无权威媒体证实。不过Meta和Llama 4项目确实面临高层动荡、模型延期等问题,还分析了可能的深层原因。
GPT-4V仅达Level-2?全球首个多模态通才段位排行榜发布,General-Level打造多模态通用AI评测新范式
General-Level团队提出全新评测框架General-Level和数据集General-Bench,构建超大规模评测基准和多模态通才模型排行榜。其用五级段位体系衡量模型通才能力,General-Bench覆盖多模态任务,排行榜分多层次榜单,目前各模型段位差异大,Level-5空缺。
企业微信给AI写了94份说明书,Claude Code现在能直接干活
北京时间8月17日,企业微信更新,将能力域从7个扩到12个,参考文档扩到94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。
陶哲轩在菲尔兹颁奖现场:数学迎来百年新危机
菲尔兹奖得主陶哲轩在ICM大会称数学迎来百年危机,上次危机是检查逻辑地基,这次是价值观地基。他以First Proof评测展示AI解数学题能力,提出“工作假设”分析数学研究目标及KPI变化和“证明过剩”问题,还给出应对之策。
腾讯混元AI Infra如何优化Hy3 Preview:一次大模型推理性能提升的技术拆解
文章聚焦腾讯混元AI Infra对Hy3 preview模型的推理性能优化。从算子优化与融合、并行策略等五大维度,剖析技术思路、算法及收益,如Attention算子单batch长文本最高加速2.95x,还提及后续显存优化等工作。
TRAE Work 上线 Design 模式:产品经理还需要 Figma 吗?
TRAE Work 上线 Design 模式,可将一句话描述变成可编辑设计稿,还能将设计稿转代码,在同一平台完成从需求到代码的链路。作者测试后发现其效率大幅提升,并分析了该模式与其他工具的区别及 AI 设计趋势。
蚂蚁开源 x SGLang Meetup技术回放解读之基于CUTE DSL的通信计算重叠算子实践
文章是对蚂蚁开源x SGLang Meetup分享的回放解读,聚焦基于CuTe DSL的通信 - 计算重叠内核实践。探讨不同通信计算重叠方案,分析在Blackwell上做GEMM + AllReduce融合算子的优势,介绍multimem指令等,还提及接入模型执行路径和性能结果。
构建会思考的测试Agent:从自动化到自主智能的演进
文章介绍面向企业级软件测试的质量数字人系统,结合大语言模型等实现从传统到自主智能测试跨越。分析专有云测试困境,指出通用AI Agent平台局限,阐述系统设计、能力及架构,展示应用成果并展望扩展场景与未来计划。
泛娱乐 AI 赛道观察: 从「猜你喜欢」到参与共创,角色才是 AI 时代最核心的资产
文章围绕AI泛娱乐产品展开,指出AI时代产品观应从二元对立转为三元共生。AI可实现个性化体验,从“猜你喜欢”到“与你共创”。还分析了不同体验心态及案例,强调角色是核心资产,未来产品可降低门槛、扩圈发展。
算力稀缺时代,如何把 GPU 用“满”
在 GPU 稀缺且利用率低的背景下,本文分析其‘用不好’的原因,探讨业界共享技术方案的局限。以腾讯云 TencentOS qGPU 为例,解析内核态虚拟化及在离线混部技术,还介绍其在多行业降本增效的实践。