「大推理模型」共找到 9678 篇相关文章

推荐文章7

别再构建多智能体了

Multi Agent应用有望成大模型应用范式,但Cognition AI团队认为2025年追求多智能体并行协作架构是歧途,存在信息孤岛和决策冲突问题。主张采用单线程线性架构与上下文工程。

AI工程化
开源动态8

狂涨 9.1K star!最近这款谷歌的AI开源应用,超级火!

介绍Google的实验性应用`Google AI Edge Gallery`,它将生成式AI模型嵌入手机,支持Android和iOS,可离线运行,有多种实用功能,在Github获9.1K star,虽处Alpha阶段但潜力大。

开源先锋
开源动态8

Linear-MoE:线性注意力遇上混合专家的开源实践

近年来,线性序列建模和混合专家(MoE)研究进步大,但两者结合研究少,相关开源实现缺失。上海人工智能实验室团队的 Linear - MoE 首次实现两者高效结合并开源技术框架,实验验证其有诸多优势。

机器之心
推荐文章7

Claude:拆书

作者借助Claude大模型换角度“拆书”,以《金刚经》《我与地坛》《传习录》《当下的力量》为例,探寻让作者写作的终极问题、真正对话对象、关键转向及暗门密码,还给出拆书Prompt。

李继刚
推荐文章7

拆解、对比与优化:LLM工具智能体的五种任务规划与执行模式

文章探讨了大语言模型驱动的AI智能体的五种任务规划与执行模式,包括ReAct、Plan-and-Execute、静态Workflow、Workflow+局部智能、模块化的分层规划,分析其优缺点、适用场景,还给出优化方法。

AI大模型应用实践
产品应用8

通义灵码编程智能体,上线!

近期 Qwen3 正式发布并开源 8 款「混合推理模型」,表现出色。通义灵码全面支持 Qwen3 并上线编程智能体,具备多种能力,支持配置 MCP 工具,集成魔搭 MCP 广场,能大幅提升开发效率。

阿里云开发者
算法论文8

DeepMind:Transformer存在拓扑缺陷,思维链治标不治本

谷歌DeepMind论文指出,Transformer架构不擅长追踪状态,思维链只是给结构性缺陷打补丁,成本高。论文主张用循环架构替代或补充纯前馈结构,还提出多个研究方向,认为下一代模型需构建‘流动的现实表示’。

机器之心
推荐文章7

给你一套框架,理解AI时代

作者综合多方观点提炼出理解AI时代的三层框架。技术栈分底层模型能力、中层基础设施、上层应用场景;价值链是供给驱动,供给侧突破创造新需求;竞争格局在通用层赢者通吃、基础设施层多元共存、应用层快速迭代。

newtype AI
新闻资讯8

卡车自动驾驶里程超10亿公里,嬴彻科技定义“货运物理AI”

2026年9月3日,嬴彻科技宣布卡车自动驾驶商业运营里程破10亿公里,以超90%市场份额领跑中国卡车智驾市场。其构建“货运物理AI”,有三大核心能力,还布局全场景货运网络,海外业务也有突破。

量子位
新闻资讯7

八年研究沉淀,原方智能试图让机器拥有关于世界的「信念」

原方智能正式启动,由林浩鑫与唐开强创立,技术源于 LAMDA 团队八年研究。其目标是使机器在物理世界形成对世界的'信念',以世界模型为核心技术路线,将研究成果推向开放物理世界。

机器之心