「可交付设计稿」共找到 5167 篇相关文章
「上下文学习」之后,腾讯混元第二篇公开研究:精准定位RLVR训练崩溃的“罪魁祸首”Token
腾讯混元团队新研究提出异常梯度定位器 GradLoc,可将全局梯度突刺定位到具体异常 token,降低 RLVR 训练观测与分析门槛,助力解决训练不稳定问题,让模型调优更科学。
视频字幕处理开源神器
卡卡字幕助手(VideoCaptioner)操作简单,无需高配置,支持 API 和本地离线语音识别,利用大语言模型处理字幕。它支持多平台视频下载处理,有专业语音识别引擎,能智能纠错、高质量翻译、调整字幕样式。
Chaterm Agent Skills + 千问大模型,智能运维再进化
文章介绍Chaterm Agent Skills与千问大模型结合用于智能运维。它能将运维经验打包成技能,提供三种模式,缩短运维时间。文中还阐述了技能概念、工作原理、技术实现及实战案例,鼓励用户尝试创建技能。
LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!
文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。
Reorx:OpenClaw 正在重塑我的数字生活,以及为什么我退订了所有 SaaS
知名技术博主 Reorx 记录用 OpenClaw 将工作流从“云端租赁”迁回“本地私有”的过程。AI 正从云端服务变为本地基础设施,他退订 SaaS 用 OpenClaw 重塑数字生活,虽有不足但能拿回数据控制权。
AgentScope 正式发布 Skills 支持 - 实现渐进式披露
文章指出大语言模型驱动的Agent系统存在核心矛盾,常见上下文加载方案有局限,缺乏灵活机制。介绍了AgentScope发布的Skill机制及渐进式披露策略,还讲了其在Java中的实现,最后分析了适用与不适用场景。
18个月,中国Token消化狂飙300倍!别乱烧钱了,清华系AI Infra帮你腰斩API成本
中国大模型API服务碎片化、“黑盒”问题严重,成本高。清程极智1月29日发布AI Ping,类似“中国版OpenRouter + Artificial Analysis”,可评测、路由大模型,帮开发者降低成本、提升效率,还能重塑服务市场秩序。
停止迷信“超级Prompt”:要想AI不犯错,你得专门雇人“怼”它
这篇来自Isotopes AI的论文指出,在生成式AI落地中,迷信‘超级Prompt’不可取。对于高风险场景,单体LLM有局限,论文构建‘AI Office’架构,引入‘对手团队’概念,实验使准确率从60%提升到92.1%,但也有成本和局限。
高效智能体的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透
随着大模型能力提升,业界关注智能体落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能体’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。
硅谷刷屏的ClawdBot,让Mac mini卖爆了!创始人爆料:一人开发、100% AI 写代码,全开源却留 0.00001% 给全网来 hack
个人 AI 助手 ClawdBot 席卷硅谷,网友评价高,项目已开源获 20.8k stars。它几乎 100% 用 AI 写代码,协作方式激进,创始人还留 0.00001% 作为“安全靶子”。其功能强大但有安全隐患,还带火了 Mac Mini。