「深度主动优化」共找到 2044 篇相关文章
Clawdbot爆火:Karpathy点赞的开源AI助理,到底是什么?
这两天AI圈被Clawdbot项目刷屏。它是能在手机已有应用中工作的AI助理,有记忆、会主动联系用户、能执行任务。它可在廉价云服务器运行,能力分两层级,成本每月25 - 150美元。
Deepseek是被降智了吗?
作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。
DeepSeek悄悄开源LPLB:用线性规划解决MoE负载不均
昨天,DeepSeek 在 GitHub 上线新代码库 LPLB 解决 MoE 负载不均。它利用线性规划算法优化专家并行工作负载分配,能处理动态波动,但也存在忽略非线性成本等局限,对 MoE 架构训练加速有参考价值。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
美团基础研发平台工程效率负责人程大同在访谈中解答了美团 AI Coding Agent 产品 NoCode 的相关问题,包括模型性能优化、产品定位、用户画像、使用边界等,还谈及与 CatPaw 的关系及未来规划。
从天价咨询到免费AI,夸克能改变志愿填报这门生意吗?
高考报志愿难题一直存在,天价咨询服务并非人人能享。夸克推出国内首个高考志愿大模型,免费生成志愿报告。它能理解复杂规则、把握考生需求,经多阶段训练优化,还搭载高考知识库,产品体验简便。
SOTA级视频编辑新方法:无需训练一句话编辑视频,背景保持100%
传统视频编辑工作流被AI重塑,但现有AI方法存在问题,多源于反演 - 编辑范式。西湖大学AGILab提出无需反演和训练的FlowDirector,开销低、支持广且能100%保持背景,还采用新策略优化。
76%的性能提升与模型无关?Karpathy 700次 Loop 实验揭开 Agent 最大误区
前OpenAI联合创始人Andrej Karpathy警示业界重视模型框架。Hugging Face实验表明优化模型外层执行机制可大幅提升Agent性能,Karpathy开源项目揭示AI价值在循环迭代。还介绍了搭建持续进化Agent的方法及注意事项。
Qwen-Scope:看穿大模型的“小心思”
Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的可解释性模块,通过在隐藏层插入SAE提取可解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,可前往Huggingface或魔搭体验。
“聊天干活”只需扫个码:微信配WorkBuddy,自家出品就是快
微信推出 ClawBot 插件,与腾讯自研 WorkBuddy 适配,接入门槛低。它像统一“任务入口”,可让用户在微信下达任务。适用于媒体记者信息预处理、深度研究、灵感沉淀等场景,使微信从“信息容器”变“任务容器”。
Karpathy点透AI认知撕裂:顶级圈子正集体患上AI狂热症
人们对AI能力认知差距大,部分人用旧版模型评判AI,而前沿模型进步多在专业领域。付费深度使用前沿模型的人有强烈AI狂热症,技术领域进展得益于奖励函数和企业级应用价值。