推理加速」共找到 2548 篇相关文章

推荐文章7

LinkedIn高管AI时代生存指南:别卷了,AI时代拼的是做人

LinkedIn首席经济机遇官Aneesh Raman称,AI时代做个真正的人,别模仿机器。技能迭代加速,需围绕AI重构工作流。他和CEO提出5C理论,还指出职业自主,领导者应尝试新事,找回人的独特性。

AIGC开放社区
新闻资讯7

Token 新译名:「智元」

文章讨论Token新译名「智元」,认为其比「词元」更合适。介绍英伟达GTC 2026上黄仁勋强调AI推理时代智元重要性,OpenClaw消耗大量智元引争议,还提及黄仁勋闭门会观点及多位大佬对「智元」译名的认可。

新智元
推荐文章7

哈萨比斯唯一官方传记首度揭秘:曾想让DeepMind脱离谷歌,还准备了一个疯狂的“B计划”

2022年ChatGPT爆发后,谷歌要求DeepMind加速商业化,坚守理想的哈萨比斯为守护独立研发权,策划“赎身计划”,想筹50亿美元脱离谷歌转公益AGI实验室,虽获投资人兴趣但计划流产,展现其在资本与理想间的艰难抉择。

AI前线
开源动态8

社区供稿丨Ring-2.5-1T,思更深,行更远

今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。

Hugging Face
新闻资讯7

不跟英伟达走老路,这家GPU公司的技术架构藏着哪些关键解?

在国产GPU上市黄金窗口期,天数智芯上市后首场发布会引发广泛讨论。其公布架构路线图,2027年前追赶英伟达,之后转向创新架构设计。还提出回归计算本质、提供高质量算力两条架构判断,并展示边端算力产品及应用。

InfoQ
算法论文8

小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型

近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。

深度学习自然语言处理
开源动态8

美团新独立APP,点不了菜只能点AI

美团新开源LongCat-Flash-Omni模型,支持多模态,在全模态基准测试达开源SOTA水准,推理快且全模态能力强。实测交互体验丝滑,其迭代逻辑清晰。该模型成功源于架构创新,美团靠软硬件结合实现虚实连接。

量子位
新闻资讯7

英伟达Thor芯片屡屡延期:车企被迫转身,供应链迎来机遇

英伟达原计划的Thor芯片因架构和设计缺陷多次跳票,性能大幅缩水至约700TOPS,打乱国产车企规划,小鹏、理想等厂商回调旧方案或加速自研。同时,也为国产芯片企业带来机遇,推动市场走向多元竞争。

芯师爷
产品应用7

GEO中,llms.txt是个啥?

GEO中llms.txt是新兴网络标准提案,分提案A(访问控制)和提案B(推理指导)。提案A类似robots.txt,控制内容用于模型训练;提案B是Markdown文件,助LLM理解网站。作者整理指南分享,盼业内出标准。

newtype AI
新闻资讯8

GPT-5编程专用版发布!独立连续编程7小时,简单任务提速10倍,VS Code就能用

OpenAI推出GPT-5-Codex特化版模型,支持独立连续编程7小时,有IDE插件版。新模型有“真·动态思考”能力,简单任务提速10倍,复杂任务推理更久。还重构了Codex产品体系,升级IDE扩展等。

量子位