光电混合算力」共找到 990 篇相关文章

开源动态8

Qwen3-Next:迈向更极致的训练推理性价比

文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。

通义千问Qwen
产品应用7

AI低质代码泛滥、API经济盛行,老牌科技厂商 F5 如何应对大模型应用“后遗症”?

F5亚太区CTO Mohan Veloo指出AI编程工具带来安全、低质代码、‘黑盒子’等问题。F5调查显示企业业务AI驱动下,安全成挑战。F5推出ADSP平台应对,还发布AI Gateway、AI助手等产品。

AI前线
开源动态8

专为“超大模型而生”,新一代训练引擎 XTuner V1 开源!

9月8日,上海AI实验室开源书生大模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超大规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。

OpenMMLab
推荐文章8

AI三问:Agent、LLM、RAG,一文厘清!

文章介绍大语言模型(LLM)、检索增强生成(RAG)和AI智能体(Agent)三种架构。阐述其概念、工作原理、应用场景、优缺点,还做了横向对比,给出选用建议,最后提及混合架构与未来趋势。

MCP Lab
7

又一个Genie 3来了!刚上线挤爆服务器,Mirage 2把世界模型玩成在线游戏

全球首款AI原生UGC游戏引擎Mirage迎来2.0版本。它能将图像转为可互动3D世界,还能用文本重塑。和Genie 3相比控制类别更丰富,虽有进展但仍有动作控制、视觉稳定等问题待解决。

新智元
新闻资讯7

GPT-5波折超乎想象!奥特曼连夜回应一切:4o重新上阵,团队紧急补救

GPT-5发布后引争议,网友看法不一。奥特曼回应将全面更新,如翻倍ChatGPT Plus用户使用限额等。OpenAI团队在AMA问答中也解答诸多问题,包括让4o回归、研究多模型并用等。

新智元
新闻资讯7

「硅谷大乱」小扎挖人细节来了:4年总包3亿美金,第一年可直接获得1亿美金,被OpenAI多人拒绝

为组建Meta超级智能团队,挽回Llama4失败局面,扎克伯格简单粗暴挖人,开出四年总包超3亿美元、首年到手1亿的薪酬,还提供领先算力。至少10名OpenAI员工拒绝,这撕裂了硅谷“使命驱动”文化。

AI寒武纪
算法论文7

李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了

本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。

机器之心
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
新闻资讯7

180亿深圳芯片黑马,华为猛下单

4月25日晚,云天励飞公告2024年营收超9亿,同比增81.3%,截至4月28日收盘市值超180亿。该公司以‘算法芯片化’为基础,在推理算力、行业赋能、消费级业务均有布局,还与华为等合作。

芯师爷