双模式引擎」共找到 982 篇相关文章

产品应用7

怎么从 ChatGPT 拿流量?送上这九条实用建议

文章指出AI问答引擎成B2B采购决策重要‘守门人’,介绍问答引擎优化(AEO)概念,还通过采访提炼九条从ChatGPT等拿流量的实用建议,如明确提问场景、了解平台差异等。

Founder Park
算法论文8

Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”

来自多高校研究人员推出可解释的生成Embedding框架GRACE,解决传统文本表征模型黑箱表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模统一,实验跨任务提升且不损生成能力。

量子位
新闻资讯8

Transformer八周年!Attention Is All You Need被引破18万封神

Transformer已满8岁,其开创性论文《Attention Is All You Need》被引超18万次,掀起生成AI革命。它催生诸多前沿产品,让人类跨入生成AI时代,虽起初未受关注,但如今影响深远,谷歌态度也在改变。

新智元
新闻资讯8

Ilya的首个模型来了!

掌握内幕的草莓哥爆料,Ilya正构建以TTT为核心的小型推理引擎。他预见传统大模型的死穴,SSI将TTT概念落地,其引擎在数据效率等方面优势明显。SSI获投资,本月或发新模型。

新智元
推荐文章7

《动手写AI Agent》多模型适配:一套代码跑通三家 LLM

上一章用火山引擎豆包 API 写了能跑的 Agent,但换模型重写代码会混乱。本章用 Adapter 模解决问题,介绍火山引擎、Claude、OpenAI 三家 API 关键差异,还分析了 Claude 工具调用格特殊之处。

AI Reading Hub
产品应用7

在北京,总要去东城体验一次“数字幻境”吧

在北京东城,XR沉浸技术落地生根,打造出多种新型消费场景。王府井有裸眼3D大屏、元宇宙沉浸场等;前门大街的科技体验馆有VR沉浸体验剧;隆福寺有索尼探梦、XR艺术空间等科技玩法。

故宫以东
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
新闻资讯7

战火升级!奥特曼正杀入脑机接口,这次不用切脑

近日,奥特曼邀专家加入脑机接口创业公司Merge Labs,计划以8.5亿美元估值融资。它将采用非侵入技术,与马斯克Neuralink的开颅手术竞争,奥特曼曾投资Neuralink但不认同其侵入做法。

新智元
开源动态8

微软、哈佛开源创新优化器:全面超越Muon,提升大模型训练效率

随着大模型训练所需计算资源爆炸增长,微软和哈佛团队联合开源优化器Dion。它利用低秩近似和解耦动量缓冲区,避免分布训练同步完整梯度,在集中和分布场景都有高效表现,性能超Muon。

AIGC开放社区
产品应用8

为何底层数据湖决定了 AI Agent 的上限?

随着 AI 落地企业进程加快,数据类型更丰富,传统企业级数据架构面临瓶颈。火山引擎构建多模态数据湖,以 Lance 为湖格,从多维度选型技术,解决存储等问题,在多行业有应用潜力。

InfoQ