推理架构」共找到 3558 篇相关文章

新闻资讯8

李飞飞的创业公司放大招:只要一个 H100 就能跑世界模型

“AI 教母”李飞飞的创业公司 World Labs 推出高效世界模型 RTFM,只需一个 H100 GPU 就能一边和用户交互,一边实时渲染 3D 世界,显著降低硬件成本和部署难度,渲染效果也不俗。

InfoQ
新闻资讯8

卡帕西8000行代码手搓ChatGPT,成本仅100美元,训练12小时CORE表现超越GPT-2,手把手教程来了

AI大神Andrej Karpathy新作nanochat,用8000行代码、100美元成本纯手搓克隆ChatGPT。它是极简全栈训练/推理pipeline,训练12小时,CORE表现超GPT - 2,还给出快速上手详细指南。

量子位
开源动态8

腾讯混元图像3.0开源榜一,工业级800亿参数可商用,附提示技巧

28日,腾讯开源800亿参数的工业级原生多模态生图模型HunyuanImage 3.0,个人和月活≤1亿公司可免费用。它是全球参数量最大、性能最好的开源图像生成模型,技术强、评估表现优,官方还整理了提示词手册。

AIGC开放社区
开源动态8

阿里王牌Agent横扫SOTA,全栈开源力压OpenAI!博士级难题一键搞定

阿里昨晚开源通义DeepResearch,在多项权威基准上表现出色,超越OpenAI、DeepSeek。模型、框架、方案全开源,开发者可在相关平台下载。它告别一问一答模式,像研究员一样工作,还构建了独特数据体系。

新智元
算法论文8

GPT-5-Codex背后AI Agentic编程技术最新全面综述!

近期OpenAI发布GPT - 5 - Codex,其背后AI Agentic Programming重塑软件开发流水线。介绍了AI Agentic编程定义、典型工作流、技术底座、主流Agent对比分类,还展望未来5大机会。

PaperAgent
算法论文8

长视频生成可以回头看了!牛津提出「记忆增稳」,速度提升12倍

牛津大学团队提出VMem,把「看过什么」写进几何小片,用基于3D几何的记忆索引替代短窗上下文,实现「一致性更强、资源更省、速度更快」,实测速度比常规管线快约12倍。

新智元
开源动态8

首个为具身智能而生的大规模强化学习框架RLinf!清华、北京中关村学院、无问芯穹等重磅开源

人工智能从‘感知’迈向‘行动’,具身智能成焦点。当前强化学习框架对具身智能支持受限,清华等机构联合开源面向具身智能的框架RLinf,提出混合式执行模式,设计灵活可扩展,在多方面表现出色。

机器之心
新闻资讯8

DeepSeek 官宣V3.1:迈向 Agent 时代的第一步!

DeepSeek 官宣发布 V3.1,称这是迈向 Agent 时代第一步。其有混合推理模式,Agent 能力全面进化,API 也全面升级,支持 Anthropic API 格式。还继续开源,9 月 5 日起调整价格,社区反响热烈。

AGI Hunt
新闻资讯7

“算力守护者”走向台前

智算中心面临功耗上升挑战,电源管理需求凸显。它从交流供电向直流架构升级,对电源管理产品在能效、功率密度和可靠性上有新要求。相关芯片厂商积极创新,推出多种解决方案。

芯师爷
算法论文8

为什么GPT-5算得出微积分,却数不清积木?

文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。

深度学习自然语言处理