我的世界」共找到 10987 篇相关文章

新闻资讯7

Morgan Stanley:中国 GPU产能、良率、价格及收入

这是Morgan Stanley对中国GPU自给自足程度研报部分内容,列出华为昇腾系列GPU 2024 - 2027年产能等情况。估算2024年中国AI GPU自给率34%,2027年将提至82%,还分析了半导体自给率提升原因及各领域国产化进程。

芯师爷
推荐文章7

AI 原生软件工程可观测性与可控制性

文章指出 AI 成研发主力军,改变软件生产方式,传统研发管理办法需升级。当前人和 AI 协作有诸多问题,介绍了研发三阶段,阐述可观测性与可控制性概念、关键指标,以及实现可控制性要素,强调二者结合构建高效研发体系。

InfoQ
开源动态8

ROLL:面向大规模语言模型高效强化学习框架

本文介绍阿里推出ROLL强化学习框架,专为LLM训练优化。它设计灵活,不同用户可用其满足业务、探索或线上指标需求。在多任务训练中性能出色,还采用创新机制提升效率,支持自定义操作,适合学术和业务场景。

阿里云开发者
产品应用8

LLM 技术在有道词典笔上应用实践

本文围绕LLM技术在有道词典笔应用展开。先分析端侧大模型落地挑战,如算力、功耗等。介绍有道词典笔等硬件及应用,对比端侧与云侧AI优劣。还阐述模型落地模式、算法优化及“子曰3数学模型”开源情况。

InfoQ
开源动态7

提示词注入攻击检测和数据集介绍

提示词注入攻击是攻击者操纵AI系统技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。

AI与安全
产品应用7

当 Agent 走出 App:WorkBuddy 朋友圈开始向外生长

9月2日深圳WorkBuddy生态发布会,展示9款联名硬件,有30多个硬件品牌、30多个Buddy应用、100多个开放平台共创伙伴参与。WorkBuddy开放Agent能力,连接伙伴资源,解决数据和专业经验难题,开放硬件、应用与平台三层,但面临价值分配等问题。

InfoQ
算法论文8

欲取代transformerSSA(次平方稀疏注意力)解读

文章解读了欲取代TransformerSSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。

Agent的潜意识
产品应用7

回归C++: 在GGUF上构建高效向量模型

Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。

Jina AI
7

华为盘古大模型:被芯片牵制“千古”模型

华为盘古大模型团队员工自曝内幕,称其受芯片限制,早期算力有限、训练困难。还指出内部存在造假、套壳等问题,如135B V2套壳Qwen 1.5 110B,pangu pro moe 72B套壳qwen 2.514b等,导致人才流失。

Agent的潜意识
开源动态7

让AI说人话,Anthropic开源内部最火skills。

周末,Anthropic官方分享并开源内部常用skills——eli5,其作用是让AI说人话,解决模型回复冗长啰嗦问题。还介绍了安装方法,指出从opus4.6起,模型coding和agent能力变强但人味淡。

探索AGI