高带宽域架构」共找到 3529 篇相关文章

新闻资讯8

Hermes Agent抄袭中国团队代码实锤!被锤后回应:你删号

AI圈现教科书级开源抄袭事件,GitHub狂揽8.5万Star的Hermes Agent被指架构级抄袭中国团队EvoMap的Evolver引擎。EvoMap公开技术对比报告,实锤两者架构度同构,而Hermes团队回应令人失望。

新智元
新闻资讯7

霍尔木兹海峡封锁18天后,芯片产业还能撑多久?

霍尔木兹海峡封锁18天,全球半导体产业担忧能源储备还能撑多久。芯片产业存在‘能源软肋’,关键材料供应有‘垄断性风险’,全球供应链有关联性风险,凸显了产业在效率与安全间寻求平衡的必要。

芯师爷
推荐文章7

实战·Agentic 上下文工程(下):实现一个可自我学习与进化的智能体原型

文章参考ACE论文架构与提示词设计,实现可自我学习与进化的ACE智能体原型。介绍整体架构、各模块实现逻辑、工作流组装测试,也指出当前问题如LLM表现波动大等,并给出改进方向。

AI大模型应用实践
算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率,挑战了对比学习范式。

机器之心
开源动态8

基于闪电注意力机制,创新效开源大模型

传统Transformer架构处理长文本和复杂推理任务有效率瓶颈,多数领先模型仍依赖传统注意力设计。MiniMax开源基于闪电注意力机制的专家混合模型Minimax,从架构、创新模块、训练框架等多方面优化,表现突出。

AIGC开放社区
产品应用8

美团之后,京东也开始自研大模型了

京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。

AIGC开放社区
新闻资讯8

让AI学会潜意识推理,Sapient发布类脑模型HRM

新加坡初创公司Sapient Intelligence发布仅2700万参数的分层推理模型HRM,在多项难度推理任务上超越大模型。它绕过大模型推理困境,借鉴大脑机制,训练效率,开源后GitHub星标突破10.3k。

AIGC开放社区
推荐文章7

2025AI产品用户需求调研报告:AI产品的用户类型细分与画像分析 | 甲子光年智库

甲子光年智库基于调研数据开展AI产品用户研究,分析目标用户界定、类型细分与画像。指出新一代AI会重塑用户习惯,需探寻产品最终形态,还给出用户需求、类型分布等多方面结论。

甲子光年
算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更准确率。

PaperAgent
开源动态8

达摩院推出多智能体框架ReasonMed,打造医学推理数据生成新范式

在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出多智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级质量数据集ReasonMed370K,验证了‘小模型 + 质量数据’的潜力。

机器之心