「机制可解释性」共找到 4679 篇相关文章
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。
通过逆向工程探秘 Claude Code 背后的运作机制
作者通过逆向工程研究Claude Code内部运作,了解其比Cursor等工具慢且贵的原因。Claude Code注重通用性和安全性,执行任务时多有安全检查,虽增加成本延迟,但更可靠,且在命令行工具中用户体验出色。
苹果ASM投放的两种方式,竞价原理与机制
苹果ASM投放模式的选择对广告效果至关重要。Basic模式适合预算有限且缺乏投放经验的开发者,操作简单但数据报告不详尽。Advanced模式则适合专业团队,提供更精准的用户定位和详尽的数据报告,以便随时调整广告策略。
谷歌开源 Colab MCP Server,AI 智能体可云端运行代码
谷歌开源 Colab MCP Server,使 AI 智能体通过 MCP 与谷歌 Colab 交互,将本地智能体工作流与云端执行环境打通,解决本地部署局限,还反映 AI 智能体与外部工具交互标准化趋势。
拳打可灵,脚踢 Veo 3,谁是物理世界的「懂王」?
多模态视频生成大模型是复杂系统工程,多为巨头游戏。MiniMax的Hailuo 02发布,ELO得分超谷歌Veo 3和快手Kling 2.0。它能呈现复杂运动,处理物理关系,提升训练推理效率,成本低,后续还将更新。
大模型Agent的下一阶段:可自我进化的AI-Agent
在人工智能飞速发展下,研究者探索让AI自我反思改进。本文作者构建自我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明自我进化能力,不同模型表现有差异,代码级进化潜力惊人。
刚刚,Claude偷偷上线隐形水印,每个字都可全球追踪!
8月2日起,Claude生成文字将带隐形水印,触发原因是欧盟AI法案透明度要求。Anthropic设计了文本隐写加文件签章两层标记,覆盖五条产品线,全球生效,但水印存在四重局限,引发用户争议。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
跨本体、长任务、可预测……Motubrain双榜登顶只是一个开始
本文围绕具身机器人展开,指出当前大多具身机器人干活存在局限。Motubrain 双榜登顶,确立通用机器人大脑干活能力参照系,它具备一脑多能、一脑贯通等能力,生数科技已开启产品落地布局。
当SFT遇上RL:基于样本学习阶段的动态策略优化机制
在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。