端到端架构」共找到 3895 篇相关文章

推荐文章8

“今天的OpenAI,就是昨天的Sun!” 杨立昆最新长谈:像Linux击溃微软一样,开源AI终将统治世界

图灵奖得主杨立昆在万字对话中阐述AI逆行逻辑,认为LLM非通向人类智能的道路,因其缺乏预测行动后果等能力。他离开Meta创立AMI Labs,专注世界模型和JEPA架构,还介绍Tapestry项目,主张开源AI将统治世界。

AI科技大本营
开源动态8

别再给AI送钱:10款开源工具省80%Claude Code Token,大项目直接砍49倍

使用Claude Code等AI编码工具常遇额度用完、账单超预期问题,80%钱浪费在冗余输出等。社区博主整理10款开源工具,适配主流AI编码工具,最高能将大项目Token消耗砍1/49,还介绍省Token习惯及互助项目。

AI工程化
产品应用8

全球医疗榜第一,中国AI杀疯了!医疗AI迈入Harness时代

火爆的Harness架构在医疗圈落地,智诊科技发布面向医疗健康行业的Agent OS平台WiseClaw 2.0。它以健康档案为核心,有三层流水线等设计,适用于多场景,且在模型、中层能力和上层治理有优势,还获融资加速发展。

新智元
推荐文章8

构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理

企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。

InfoQ
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合自编码器

本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。

力学与人工智能
开源动态8

Transformer 中的专家混合模型 (MoE)

文章介绍Transformer中专家混合模型(MoE),它能解决稠密模型扩展瓶颈。阐述其优势,如计算高效、适合并行等,还介绍在transformers库中支持稀疏架构的演进,包括权重加载重构、专家执行后、专家并行及训练方案。

Hugging Face
新闻资讯8

黄仁勋 × Lex Fridman:NVIDIA 4 万亿市值背后的 AI 革命

黄仁勋与Lex Fridman进行两小时访谈,从Amdahl定律聊人类意识。谈及NVIDIA发展,如CUDA决策致市值下跌后回升;提出AI扩展定律,认为智能由算力决定;还分享管理、技术预判等看法及对中国创新的评价。

宝玉AI
新闻资讯8

首发 | 捏 Ta 完成超千万美金 PreA+ 轮融资,定义 AI 时代世界创作的基础设施

近日,AI原生社区捏Ta宣布完成超千万美金的Pre A+轮融资,由九坤创投领投,BV百度风投跟投等。此轮融资用于招人才、技术研发和拓展产品线。平台从创作角色升级构建世界,定义‘世界表达协议层’。

Founder Park
新闻资讯7

xAI员工赢麻了!全员换股SpaceX,AI月烧10亿美元终于有人兜底了

今天凌晨,计划今年 IPO 的 SpaceX 收购 xAI,全股票交易,新公司估值 1.25 万亿美元。马斯克阐明“太空 AI 算力”路线,认为未来两三年,AI 计算成本最低的地方会在太空,但面临诸多问题。此次合并或是为 IPO 铺路。

AI前线