善意的混乱」共找到 10580 篇相关文章

产品应用8

“10x Cursor”开发体验, Claude Code 如何带来 AI Coding L4 时刻?|Best Ideas

文章聚焦 Claude Code,探讨其在 AI Coding 领域表现。开发者因成本低、效率高、异步开发等优势迁移至此。虽其 CLI 形态爆火,但 GUI 才是未来。Claude Code 达 L4 级别,也指出当前 AI coding 产品不足与未来机会。

海外独角兽
算法论文8

谷歌新论文把内存股价干崩了!KV cache压缩6倍,“谷歌DeepSeek时刻”

谷歌研究院推出TurboQuant压缩算法,可将AI推理中最吃内存KV cache压缩至少6倍且精度零损失,还能8倍加速计算。虽引发存储芯片巨头股价下跌,但目前只是实验室成果,仅解决推理阶段内存问题。

量子位
新闻资讯7

刚刚,微软CEO 宣布:AI 医生诊断准确率已达85.5%,是人类医生4倍

微软CEO宣布其AI诊断系统MAI - DxO在304个病例测试中诊断准确率达85.5%,是人类医生4倍。该系统模拟虚拟医生团队,既准又省,但也引发诸多质疑,微软认为AI是医生补充,未来是人机协作时代。

AGI Hunt
产品应用8

奥特曼亲自上阵,Images 2.0登顶王座!大米刻字,生图跨入GPT-5时代

OpenAI上线ChatGPT Images 2.0,奥特曼称其是从GPT - 3到GPT - 5飞跃。它是首个‘会思考’图像AI,能精准听懂中文指令、渲染复杂UI,在Arena榜单登顶,解决了多语言、风格等痛点。

新智元
推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构优势和能力。

AI科技评论
算法论文8

突破显存瓶颈:基于 DeepSeek-V3.2-Exp Latent Cache 卸载预取方案设计与模拟验证

百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。

InfoQ
开源动态7

强迫模型自我争论,递归思考版CoT热度飙升!网友:这不就是大多数推理模型套路吗?

近日,概念CoRT火了,它在CoT基础上加了“递归思考”,能让AI递归思考响应、生成替代方案并选最优,结合“结构化自我批判”提升推理力。不过网友质疑它是“新瓶装旧酒”。

机器之心
算法论文8

总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练未来

明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。

AIGC开放社区
产品应用7

Subagents:构建高可靠 AI Coding 专家顾问团

文章探讨 Claude Code Subagents 功能在复杂 AI 编程场景价值与实践。指出复杂 AI Coding 面临上下文膨胀等问题,而 Subagents 可创建专属子代理,有 Context 保护等优点,还介绍使用方法、业务实践及相关思考。

阿里云开发者
新闻资讯8

刚刚,Thinking Machines Lab首次发长文,揭开LLM推理不确定性真相

Thinking Machines Lab发长文《克服LLM推理中不确定性》,指出大语言模型推理不确定性真正元凶是缺乏批次不变性,还解释核函数计算中数字加法顺序问题,介绍使核具有批次不变性方法并给出实验结果。

机器之心