底层架构创新」共找到 2732 篇相关文章

产品应用8

基于AI大模型的故障诊断与根因分析落地实现

文章围绕基于AI大模型的故障诊断与根因分析展开,介绍项目背景、目标与原理,阐述要解决的运维痛点及技术架构、知识库构建,还提及ReAct模式实现、Dify工作流及ClaudeCode对比,目前根因定位成功率有所提升。

阿里云开发者
算法论文8

LinearRAG:一种免关系提取的高效 GraphRAG 图构建方法

研究指出 GraphRAG 模型在实际应用中表现常不如朴素 RAG 方法,原因是自动构建的知识图谱质量不佳。为此提出 LinearRAG 框架,有三大核心创新,在四大基准数据集上全面超越现有方法,代码和数据已开源。

深度学习自然语言处理
算法论文8

首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒

新加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决核心难题,实验性能超基线,为多领域应用提供落地基座。

量子位
产品应用7

抢先体验GenFlow2.0:未来多Agent协作的理想形态

作者在百度邀测会抢先体验Genflow 2.0,用其解决小学教改信息查询问题,还让它生成创意图片。它得益于“沧舟OS”,有流畅、并发且跨模态能力,架构全自研,测试版亮点多,值得期待8月正式上线。

AI产品黄叔
开源动态8

媲美DeepSeek!腾讯开源新版混元模型:AI Agent强化,超30种智能体指令

腾讯开源混元大模型最新版本Hunyuan - A13B,为专家混合模型,有800亿参数,130亿激活。支持快慢思考模式,针对AI Agent强化,设计超30种智能体指令。测试成绩超DeepSeek - R1等,架构和训练有优化。

AIGC开放社区
推荐文章7

用AI写代码的真实体验:聪明却“不靠谱”的顾问,你敢用吗?

作者Luke Kanies曾是AI与LLM怀疑者,试用Vibe Coding后,认为要把AI当不太靠谱的外部顾问。用AI学Swift编程,发现它是糟糕架构师,但找语法错误快,相处中可让其做琐碎工作,不能全信它。

宝玉AI
新闻资讯8

不换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律

2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。

新智元
算法论文8

LeCun在Meta的最后一篇论文

LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。

量子位
新闻资讯7

他想让TPU成为AI界的X86!

2026世界人工智能大会期间,中昊芯英主办分论坛,新一代全自研TPU架构AI芯片“须臾®”亮相,华东地区首个国产TPU智算千卡集群落成。“须臾®”算力强、成本低,集群全链路国产化,中昊芯英探索TPU突围路径。

芯师爷
推荐文章8

必看!Sebastian Raschka新博客盘点了所有主要注意力机制

著名AI技术作家Sebastian Raschka发布博客《现代LLM中注意力变体的可视化指南》,回顾近年开发并用于开放权重架构的注意力变体,包括多头、分组查询、多头潜在等注意力机制,还分析各机制特点、应用场景及优劣势。

机器之心