双模式推理」共找到 2638 篇相关文章

新闻资讯8

一次汇报,资源投入暴涨数十倍:快手大模型推荐以 1/12 成本突围,技术负责人亲历的革新故事

InfoQ 专访快手科技副总裁周国睿,他分享了快手大模型推荐技术投入挑战、决策过程等。如汇报后资源投入涨数十倍,以 1/12 成本突围。还阐述推荐系统变革、技术押注及未来推荐系统突破点等观点。

InfoQ
新闻资讯7

OpenAI 不想再「跪着」买显卡了

《金融时报》消息,OpenAI 正和博通合作自研代号“XPU”的 AI 推理芯片,2026 年量产。其不仅在芯片发力,还在硬件、应用和算力基建多线出击,不过自研芯片也面临资金、人才和软件生态等问题。

AI科技评论
新闻资讯7

别误会00后了!美国千人调查揭秘:85%学生都用AI,首要目的不是偷懒

国外机构调查1047名学生,结果显示约85%学生过去一年用生成AI处理课程作业,主要用于头脑风暴、答疑与备考。学生希望学校规范AI使用,教师用AI教学学生看法不一,AI重塑大学价值评估体系。

新智元
开源动态8

SGLang支持GPT-OSS:从Day 0支持到性能增强

SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。

GiantPandaLLM
新闻资讯7

刚刚,DeepSeek最新发文!V3/R1训练细节全公开,信息量巨大

网信办新规生效,DeepSeek回应,标注AI生成内容,公开V3/R1训练细节。介绍训练分预训练和优化训练,深挖数据使用,还谈及推理、开源情况,也提到对抗AI幻觉与滥用风险的措施。

新智元
新闻资讯8

OpenAI高管自爆:Scaling不死,GPT-5「双轴训练」撕开智能天花板

OpenAI首席运营官Brad Lightcap在对话中揭秘GPT-5,其能自主判断是否深度推理再作答,体验全面升级。训练方有后训练,Scaling Law仍成立,未来从两轴改进。还探讨了AGI、应用场景等。

新智元
算法论文8

UNC | 发布Bifrost-1,构建“最强大脑”与“顶级画师”的桥梁,低成本实现“文生图”自由

随着AI发展,打造能推理又能创作的系统成为焦点。但让LLM学习视觉创作面临训练成本高和能力受损问题。BIFROST - 1框架在MLLM和扩散模型间建通信信道,解决核心痛点,实验表现出色。

AINLPer
新闻资讯7

AI 的「成本」,正在把所有人都拖下水

文章指出,虽大模型成本下降,但 AI 公司仍难盈利。因市场追逐新模型,且模型消耗算力单位剧增。如 Anthropic 的不限量套餐失败,各公司陷入囚徒困境,还给出按使用量计费等破局思路。

AI科技大本营
新闻资讯7

Remix 3终结以React为中心的架构

多年来,React 一直是全栈 JavaScript 架构基础。但 Remix 3 挑战了这一局面,它遵循渐进增强和服务器优先原则,将 Web 基本原理置于核心,重新定义构建方,引发对 React 中心架构的思考。

InfoQ
推荐文章7

扩散架构 or「NoThinking」,AI 对话的「1Hz 壁垒」如何突破?

当红通用人形机器人公司 1X 的 AI 副总裁 Eric Jang 提出「智能频谱」概念,阐述当前 AI 面临的「1Hz 壁垒」及实现「Ultra Instinct」能力的先决条件。不同推理方案有望解决部分问题,但通用智能体仍有瓶颈。

机器之心