「新推理模型」共找到 9817 篇相关文章
英伟达拟 10 亿美元砸向这家 AI 编码创企!Copilot 技术大佬带队、成立两年估值近千亿
10月30日彭博社报道,英伟达拟最高投10亿美元给AI创企Poolside,此轮融资或使其估值翻四倍。该公司由微软技术大佬带队,开发AI编码助手,创建强化学习法训练模型,从底层自研,有独特优势。
DeepSeek,Qwen,Grok组团发布,社区一手实测
LLM大爆发,一天内推出Grok 4.6、Qwen3.8 - Max、DeepSeek - V4 - Pro - 0813三款前沿产品。社区对它们进行多场景测试,如3D场景、Flappy游戏、飞机滑行动画等,并对比了不同模型的性能、价格和输出质量。
奥特曼首曝GPT-6,亲口承认GPT-5「搞砸了」!接入大脑读心,估值或飙破5000亿
奥特曼在旧金山采访中透露GPT-6相关信息,坦言GPT-5发布‘搞砸了’,GPT-6主打个性化记忆功能。OpenAI新一轮融资后估值或达5000亿美金,但投入算力成本高,其估值也存泡沫争议。
基于Memory Bank的Cursor长会话记忆内存库理论研究与实践
文章围绕Memory Bank展开,介绍其为解决大模型长会话记忆瓶颈而设计的机制,包括存储、检索、更新模块。阐述其在编程和知识库建设的应用,还评测了Codelf等工具,指出Memory Bank是AI迈向智能的重要一步。
去了一趟中国AI实验室,Linux基金会CTO感叹:西方那两套偏见全破产了
Linux 基金会全球 AI 技术官 Matt White 访华后称,西方对中国 AI 的偏见破产。中国实验室文化黏性强、人才回流,工具反向输出美国。他指出西方出口管制未卡死中国,还让其成自研芯片‘卷王’,开源模型也更受青睐。
实测LibTV团队版:AI视频的工作室时代来了!
作者实测LibTV团队版,分享用其制作皮克斯风格3D动画片段的过程,介绍团队版核心功能,如团队主体库、共享积分池、权限管理等,还提及新功能,指出AI视频走向工业化,而该团队版是首个专注团队协作的工具。
存储的超级周期,缺货潮将贯穿2026年?
近期存储市场火热,价格飞涨,下游厂商面临成本压力。缺货潮或贯穿2026年,因AI需求爆发,三大厂商减产DDR4等产能。其他厂商难补缺口,华邦虽有扩产计划但周期长。端侧AI发展对存储有新要求,华邦布局相关产品。
「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?
本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。
全网爆火的DeepSeek「UE8M0 FP8」,原来英伟达早已支持
NVIDIA PTX ISA文档早有.ue8m0数据类型,UE8M0 fp8并非DeepSeek独创。从PTX 8.0/9.0起,NVIDIA在ISA级别支持.ue8m0,H100、RTX 40系列等都有相关支持,DeepSeek是将其提升到模型层面。
Meta华人天才毕树超「叛逃」预言:OpenAI未竟交互革命,暗藏万亿赛道
Meta科学家毕树超在演讲中揭秘AI进化真突破,认为更好更快造数据是关键。他指出AI原生交互领域若有新突破,或催生万亿级公司,语音和视觉将成重要部分,还分享了AI进化时间线及面临的问题和未来图景。