端到端架构」共找到 3845 篇相关文章

推荐文章7

从BM25Multi-Vector:6种Embedding演进路线

文章介绍6种Embedding演进路线,包括Sparse、Dense等,分析其特点、痛点、效果和案例,还给出选型建议,如关键词匹配选Sparse,长文本定位选Multi - Vector,也提及方案选择步骤。

CourseAI
新闻资讯8

AI基础架构重大突破,计算成本暴降38倍

Perforated AI团队搞出‘穿孔反向传播’技术,给旧神经元加‘人工树突’。测试中计算成本最高降38倍,模型准确率不降反升,还近乎即插即用。这或引发行业变革,但也面临验证、生态和收费等挑战。

AIGC开放社区
算法论文8

语言反思>强化学习:伯克利新架构碾压传统RL

大型语言模型下游任务优化依赖强化学习,但计算成本高。伯克利等机构论文提出GEPA新型优化器,将LLM执行轨迹转化为诊断信号,用语言反馈替代标量奖励,仅用传统方法1/35计算量,性能最高提升19%。

深度学习自然语言处理
新闻资讯7

Kimi K2里找了DeepSeek V3架构

Kimi新模型K2热度高,在多benchmark上达SOTA,网友好评多。Kimi工程师透露K2开源原因,还谈及Kimi发展策略。实测显示K2在前制作、工具调用、创意写作上表现出色。此外,OpenAI开源模型推迟,引发猜测。

量子位
推荐文章7

搜索领域的下一个重大转变:从产品基础设施

Lightspeed投资人称搜索正从人类产品转变为AI基础设施,像云计算支撑互联网,搜索将为AI提供信息。各公司集成搜索进展不同,还分析了搜索成基础设施带来的变化及新机会。

Founder Park
产品应用7

从扭秧歌跑半马:机器人离「iPhone时刻」还有多远?

过去半年,机器人表演把人们认知拉进现实。当下具身智能赛道玩家关注缩短探索周期、降低成本。地瓜机器人发布 RDK S100 套件,其有独特设计和适配场景,还围绕开发者诉求提供支持,跑通多种场景。

机器之心
推荐文章7

200行python代码实现从Bigram模型LLM

本文从`babygpt_v1.py`出发,逐步加入self-attention机制、position嵌入等,实现完整GPT。介绍Transformer结构,讲解位置编码、单头自注意力等机制的代码实现,还阐述后续层的用途、参数调整及训练效果,最后提及模型优化方向。

阿里云开发者
新闻资讯7

一种用于管理 AI 变革步伐的演进式架构模式

Cloudflare推出基于QuePaxa共识算法的Meerkat服务,可无领导者写入并保持强一致性,提高网络可用性。它预计将是QuePaxa全球首次生产部署,但存在局限性,如大量往返通信。

InfoQ
算法论文7

从 RLVR RLSVR:开放式任务如何获得可核验奖励

COLM 2026 论文提出 RLSVR 及 SpyRL,把摘要等开放任务变成“谁是卧底”游戏,用投票生成可核验奖励,在多任务有提升,但也暴露代理目标与质量关系、成本等问题。

深度学习自然语言处理
产品应用8

实测 MiniMax H3:开源“斩杀线”蔓延视频模型圈

本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。

特工宇宙