麦琪的花园」共找到 10570 篇相关文章

推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构优势和能力。

AI科技评论
算法论文8

突破显存瓶颈:基于 DeepSeek-V3.2-Exp Latent Cache 卸载预取方案设计与模拟验证

百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。

InfoQ
开源动态7

强迫模型自我争论,递归思考版CoT热度飙升!网友:这不就是大多数推理模型套路吗?

近日,概念CoRT火了,它在CoT基础上加了“递归思考”,能让AI递归思考响应、生成替代方案并选最优,结合“结构化自我批判”提升推理力。不过网友质疑它是“新瓶装旧酒”。

机器之心
算法论文8

总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练未来

明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。

AIGC开放社区
产品应用7

Subagents:构建高可靠 AI Coding 专家顾问团

文章探讨 Claude Code Subagents 功能在复杂 AI 编程场景价值与实践。指出复杂 AI Coding 面临上下文膨胀等问题,而 Subagents 可创建专属子代理,有 Context 保护等优点,还介绍使用方法、业务实践及相关思考。

阿里云开发者
新闻资讯8

刚刚,Thinking Machines Lab首次发长文,揭开LLM推理不确定性真相

Thinking Machines Lab发长文《克服LLM推理中不确定性》,指出大语言模型推理不确定性真正元凶是缺乏批次不变性,还解释核函数计算中数字加法顺序问题,介绍使核具有批次不变性方法并给出实验结果。

机器之心
新闻资讯7

兵临OpenAI!谷歌集结2500人「复仇」,Gemini 3夺回AI王座

谷歌发布Gemini 3欲夺回AI主导权。谷歌DeepMindCTO与AI Studio产品负责人剖析其发布盛况等,称这是与全球用户共建AGI实验,还谈到模型发展、应用及多模态等问题,也承认仍有提升空间。

新智元
算法论文8

小模型大作为!微博VibeThinker-1.5B超越DeepSeek R1等头部大模型

近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。

深度学习自然语言处理
推荐文章8

Sam亲自泼冷水,GPT-5意外失手:我们对AI期待,是否已被整个行业误判?

科技行业集体转向 AI,高管强调其变革性,可 OpenAI Sam Altman 却泼冷水,提醒投资者高估回报。文中围绕‘AI 是否放缓’展开讨论,还分析了 GPT - 5 发布遇冷原因、AI 对就业影响等,指出 AI 发展多且快,未来潜力巨大。

InfoQ
开源动态7

我去,程序员福音啊?2.69 万 Star Maple Mono,真心不错,我已经用上啦~~~

介绍开源编程字体 Maple Mono,它将圆角、连字等多种特性融入一套字体,能提升代码可读性、优化符号表达等,解决了程序员高频痛点,但也有局限性,建议试用。

小华同学ai