「AI工程架构」共找到 10888 篇相关文章

开源动态8

DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持

Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,在多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。

AI工程化
推荐文章8

/phodal-writer:如何把十年写作经验整理成一个 Skill

作者Phodal分享将十年写作经验整理成写作Skill的过程。指出用AI写作输出不稳定,问题在于未将写作决策工程化。经样本整理、模式提取、规则改写等步骤,形成可复用的写作系统,强调其可放大经验可迁移性。

phodal
新闻资讯7

Anthropic 研究员:强化学习将推动 Transformer 实现 AGI

在 AI Agenda Live 纽约活动上,Anthropic 强化学习团队技术负责人 Sholto Douglas 称,无需新架构突破,强化学习能让 Transformer 达人类专家级别表现,接近 AGI。但定义「好表现」是难题,Anthropic 或投 10 亿美元提升模型企业应用表现。

AGI Hunt
新闻资讯7

老黄回应英伟达入股英特尔

英伟达50亿美元入股英特尔,将持有超4%股份成大股东之一。双方要联合开发用于PC和数据中心的AI芯片,未来芯片或成CPU与GPU融合的超级芯片。此合作或冲击AMD和台积电。

量子位
新闻资讯8

Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?

InfoQ《极客有约》X AICon 直播栏目邀请京东、荣耀等专家探讨生成式推荐落地洞察。指出搜广推领域 scaling law 仍成立,大模型改变特征工程等,还分享了系统架构、模型应用等方面经验及挑战。

InfoQ
产品应用8

通向L3的正确范式?理想i8全球首发VLA高阶辅助驾驶,我们帮你试了试

本周二,理想全新纯电SUV理想i8上市,其搭载的VLA辅助驾驶系统受关注。理想发现端到端数据驱动升级有局限,VLA架构改进让系统有思维、沟通等能力,还带来平顺性等提升,且研发各方面能力强。

机器之心
推荐文章8

必看!Sebastian Raschka新博客盘点了所有主要注意力机制

著名AI技术作家Sebastian Raschka发布博客《现代LLM中注意力变体的可视化指南》,回顾近年开发并用于开放权重架构的注意力变体,包括多头、分组查询、多头潜在等注意力机制,还分析各机制特点、应用场景及优劣势。

机器之心
产品应用7

10个Agent一键组队:并行智能体协作,端到端交付从24h缩减到4h!

过去写代码靠程序员手动输入,即便有Copilot等工具,仍需人主导。并行代理出现后,程序员可调用多个AI并行工作,将端到端交付时间从24h缩减到4h,思维方式也需转变,对工程师能力要求也有变化。

新智元
开源动态8

冲上热搜!美团大模型,靠「快」火了

国内外开发者亲测,美团新开源的LongCat - Flash - Chat模型速度超快,推理速度超每秒100个token。它来自美团LongCat - Flash系列,官网可直接用。该模型架构创新,训练方法高效,还做了专属和系统级优化,跑起来又快又便宜。

机器之心
产品应用7

2499 元产品背后:地瓜机器人将智驾 know-how 转为机器人新解法

AI重塑机器人技术边界,具身智能成新战场。地瓜机器人从地平线拆分,将智驾经验用于机器人。它提出大小脑分层架构落地更快,还推出RDK S100套件,搭建具身智能底座应对数据和应用难题。

AI科技评论