「大模型自信问题」共找到 9547 篇相关文章
抢天才还是拼算力?前 Llama 推理负责人详解 AI 的真实天花板
前 Llama 推理负责人 Ross Taylor 在播客访谈中指出,AI 竞赛中的混乱和挖角是噪声,最终会被指数级算力淹没。他阐释了算力指数曲线决定竞赛天花板,强调系统性实验、高质量评估的重要性。
含全文!OpenAI发布GPT-5官方Prompt指南
OpenAI 发布《GPT-5 prompting guide》,介绍新模型变化及使用方法。新增 `reasoning_effort` 和 `verbosity` 参数,还有 Responses API。Cursor 分享实战心得,同时提及控制 Agent 积极性、解决指令冲突等内容。
为什么 AI Agents 按结果定价这么难?
文章探讨AI Agents按结果定价难的问题。指出因技术、组织和文化基础设施缺失,短期内该模式是“海市蜃楼”,分析归因、衡量、信任、组织、市场等方面难题,也给出务实推进步骤。
全球独家首测Genie 3,实验室细节曝光超震撼!AGI最后一块拼图已实现
谷歌DeepMind的Genie 3发布,Youtuber全球独家首测,揭秘实验室细节。前谷歌研究员称其将颠覆游戏行业,它有诸多亮点,但也存在物理、社交交互等未解决问题,代表娱乐未来。
刚刚,清华团队用27M参数击败o3-mini!或将改变AI发展方向
清华大学研究团队发布论文,展示Hierarchical Reasoning Model(HRM)。该模型仅27M参数、1000个训练样本,在推理任务上击败OpenAI的o3 - mini - high,或改变AI发展方向。
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
Tokenization谢幕?H-Net登场:Mamba作者新作正面硬刚Transformer
「Mamba」作者之一Albert Gu在新Paper提出新技术,实现动态分块机制,嵌入H - Net可替代传统流水线。在多方面实验中,H - Net性能优于基于BPE token的Transformer模型。
Grok 4作战图刷爆全网,80%华人横扫硅谷!清华上交校友领衔,95后站C位
Grok 4一夜爆火硅谷,一张内部作战图显示其幕后团队华人学者占比达80%,包括Jimmy Ba、吴怀宇等。独立评测中Grok 4成绩优异,但也有人质疑其代码基准结果有过拟合嫌疑。
摩尔线程之后,又一家国产 GPU 独角兽完成上市辅导
6月23日,国产GPU龙头沐曦IPO辅导完成,将提交申报材料。其为异构计算提供全栈GPU方案,产品有曦思N、曦云C、曦彩G系列。曾与书生・浦语3.0合作,2024年交付多个算力集群。此外,国产GPU厂商纷纷IPO。
外媒爆料:美国AI马歇尔计划预备开启,却被特朗普搞砸了!
外媒爆料美国本酝酿「AI马歇尔计划」围堵中国,重塑全球AI秩序。但特朗普政府无能,得罪盟友致单打独斗,计划未启动且碎片化。Axios建言美国按步骤启动,并提出政府、企业等应对举措。