「论文Skill」共找到 1341 篇相关文章
DeepSeek V4即将发布?先读懂梁文峰这份86页的技术底牌
据报道,DeepSeek计划2月中旬发布V4,此前将R1论文从22页扩充到86页。新增内容涵盖训练细节、成本、数据配方等,还公开失败案例、基础设施和安全报告,或为V4铺路并回应质疑。
综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能
大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。
生成式推荐补上关键一环!语义ID首次实现可微分联合优化 | SIGIR'26
生成式推荐依赖语义ID,可现有语义ID常先学好再冻结,与推荐目标不一致。论文DIGER首次将可微分语义索引机制引入生成式推荐框架,让推荐损失参与语义ID学习,还设计策略解决训练问题,实验表现佳。
边画边想!多模态Reasoning迎来巨大提升!
论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。
4.8K Star!一套面向设计工程师的 AI 编码智能体 UI 技能集合!
前端开发中AI生成代码质量参差不齐,ui - skills项目应运而生。它由开发者ibelick创建,是面向设计工程师的UI技能集合,将开发经验转化为规则,通过CLI工具让AI按规则构建和审查代码,已获4.8k Stars。
一款产品,同时为人类和 Agent 设计,LibTV 是怎么做的?
3月18日,LiblibAI旗下AI视频创作平台LibTV上线,它从设计之初就兼顾人类创作者和Agent。创作者端工作流画布可控;Agent端可通过Skill接口创作,交付可编辑项目。该产品还针对两者差异做了设计,价格也便宜。
挺意外的,Agent长期记忆潜力被AMemGym挖出来了
论文提出交互式在线策略评测框架AMemGym,它能反映AI助手长期记忆能力、驱动Agent自我进化记忆。它以结构化状态演化为骨架支撑自由对话评测,还对主流记忆系统做了扫描,带来评估与训练范式转换。
具身AI当立!这是我分析完7篇最新Paper得出的结论~
作者分析7篇来自蚂蚁、小米、高德的具身AI论文,认为行业要变天。蚂蚁打通全链路并开源,小米让VLA在消费级显卡跑,高德重构数据和架构。具身AI正从‘手工业’走向‘工业革命’。
全靠Claude Code 10天赶工上线,Cowork 删用户11G文件不含糊!核心研发:长时间打磨再发布很难成功
Anthropic发布的Claude Cowork研究预览版问题频出,如删用户文件、窃取文件。与Claude Code对比,它交互繁琐、效率滞后。不过核心研发称快速上线再迭代,未来Agent类应用界面会趋简,Skills是关键。
学生3年投稿6次被拒,于是吴恩达亲手搓了个评审Agent
机器学习大佬吴恩达为投稿屡被拒的学生,做了免费AI论文评审智能体。它在ICLR 2025审稿数据训练,与人类审稿相关系数达0.42,能按会议风格评审,还提修改建议,可体验。