「推理与计算」共找到 8173 篇相关文章
Sam Altman宣告软件开发即将进入"快时尚时代"!机遇还是危机
Sam Altman宣告SaaS将进入快时尚时代,新的GPT - 5编程能力或让开发SaaS像Zara出新款般轻松。但此概念最早由Patricio提出,他认为AI编程会带来‘代码污染’,与Sam态度不同。
半量工具,双倍效能:ARPO革新大模型强化学习
大语言模型在多轮工具调用场景有挑战,传统强化学习算法有探索效率低和资源消耗大问题。本文提出ARPO,通过量化token熵分布变化设计自适应探索机制,降低工具调用成本且提升多轮推理性能。
AI编程界炸出新黑马!吊打Cursor、叫板Claude Code,工程师曝:逆袭全靠AI自己死磕
近期,AI编程黑马AmpCode崛起,与Claude Code并列S级,吊打Cursor。Sourcegraph工程师分享其研发理念,认为应放权给模型。此外,还探讨了企业对AI工具的分歧、编程工具变革及AI对开源的影响。
ChatGPT大更新推出学习模式!“一夜之间1000个套壳应用又死了”
ChatGPT大更新,推出学习模式,像老师般引导思考,对多类用户开放。它由OpenAI与多方合作打造,结合学习科学成果。目前用提示词实现,未来会训练进模型,还将多方面改进,或重塑教育模式。
不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果
上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。
DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO
论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更高。
AI教父辛顿上海WAIC主题演讲:LLM真的理解语言,数字智能极其危险,可以无限复制
AI教父杰弗里·辛顿在WAIC开幕式演讲,对AI发展警惕且悲观。他认为LLM真理解语言,数字智能与生物智能差异大,AI进化快很危险,人类应全球合作研究让AI向善。
OpenAI拿下IMO金牌,职业数学家崩溃:我终于明白李世石为何会落泪
AI在IMO获金牌,数学家Dave White自我认同崩塌,认为这是一种‘死亡’,探讨AGI带来的身份危机。加密教授Adam Cochran则从哲学视角回应,称人生身份重建与崩塌不断循环,真正的‘自我’超越单一标签。
一起聊聊Nvidia Blackwell新特性之低比特GEMM
本文是NVIDIA Blackwell架构GEMM研究系列文章第三部分,介绍低精度计算,探讨Blackwell GEMM如何执行,关注6位和4位格式及对内存布局影响。还提及低精度优势、数据格式、UMMA实现、操作限制、CUTLASS抽象方式等。
烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?
集成 AI Agent 竞赛打响,2024 年中国 AI Agent 软件市场规模破 50 亿。InfoQ 对话来也科技汪冠春和英科医疗陈坤,从不同角度谈产品理念与应用策略,涉及引入时间、定位、推广、架构调整等多方面内容。