存算分离」共找到 540 篇相关文章

8

ART:构建可靠智能体的强化学习新框架

现有AI智能体在真实场景表现不稳定,阻碍其应用走向生产。ART开源强化学习框架诞生,通过分离“前端”与“后端”、兼容OpenAI推理端点等创新化解困境,还给出使用方法,在案例中展现强大效能与经济性。

AI工程化
7

2027年实现AGI?计物理学家怒怼:纯属无稽之谈!

知名博主Scott Alexander领衔的项目称AI将在2027年达超人智能。但计物理学家经研究指出,该预测模型漏洞百出,如数学错误、曲线选择无依据、图表与模型不符等,即便新模型改进部分问题,多数批判仍成立。

AGI Hunt
新闻资讯8

黄仁勋发布量子计专用CUDA!预言量子计机几年内应用,但现在还离不开GB200

在GTC巴黎演讲中,英伟达CEO黄仁勋预言量子计机几年内可实际应用,还推出量子-经典加速超平台CUDA - Q。此外,他提及物理AI是战略核心,有巨大市场机会,还展示多款产品与技术。

量子位
新闻资讯7

星际之门内部惊人曝光:40万块GPU爆铺!奥特曼千亿豪赌险把电网干崩

记者深入阿比林基地,揭开「星际之门」超神秘面纱。该项目由OpenAI、软银、甲骨文合作,已投1000亿美元,后续将达5000亿。它含8个建筑、40万块GPU,面临能源挑战,巨额投资也伴巨大风险。

新智元
算法论文8

Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率

当前主流大模型如QwQ - 32B在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。

深度学习自然语言处理
新闻资讯7

撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍

J - Space Cognition Suite社区项目在X上传播,称不修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。

InfoQ
新闻资讯7

为什么HBM能摆脱传统周期?

当前市场对HBM和DRAM能否摆脱传统半导体周期性争议。过去半导体周期由消费电子换机节奏驱动,而AI推理不同,大模型推理对内依赖是硬约束,GPU更新对HBM需求几乎注定指数级增长。

newtype AI
新闻资讯7

马斯克22万张GPU全卖给Claude用:5小时限额翻倍,双方合作建太空

马斯克和Anthropic签署力合作协议,将旗下Colossus 1超集群全部给Claude用。此前马斯克抨击过Anthropic,合作后态度转变。此交易或改写AI力格局,且三家计划IPO的公司故事也因此改写。

量子位
推荐文章7

《动手写AI Agent》会话与记忆:记住上次聊到哪了

文章围绕《动手写AI Agent》的会话与记忆展开,指出LLM无状态、无会话持久化会让对话记录丢失。介绍了解决方案,如把对话到磁盘及构建长期记忆,阐述设计决策并提到文件系统储方案。

AI Reading Hub
新闻资讯7

谷歌TPU能撼动英伟达吗?前TPU工程师首次揭秘

在AI力争霸时代,英伟达GPU市值狂飙,但蛋糕正被分食。前谷歌TPU工程师Henry揭秘TPU,从架构、产能、软件等维度分析其优缺点,指出在特定条件下TPU可挑战GPU,未来芯片市场将百花齐放。

芯师爷