重排技术」共找到 3666 篇相关文章

产品应用7

Cherry Studio 复盘:从 Chat 到 Agent,一款「套壳」开源产品如何推倒来?

Cherry Studio最初是为用户在不同大模型间切换的聊天客户端,随行业从Chat转向Agent,它开启2.0版本构,定位转向「个人Agent平台」,底层架构写,要解决产品复杂性、完善协作等问题。

Founder Park
算法论文7

Meta|提出RECAP,通过动态目标加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型在多任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
产品应用7

如何让 AI 成为你的编程搭档?一次真实构告诉你答案

文章介绍编程工具Cursor,它是基于VS Code、深度集成AI的智能代码编辑器,有多种模式,能力强但有局限。作者分享用其完成构需求的过程、经验,还提及使用中踩坑及应对方案,最后总结提效成果。

阿里云开发者
新闻资讯7

Grok 4意外提前曝光,xAI巨额融资700亿,马斯克宣布“写人类知识库”

xAI的Grok 4提前泄露,团队跳过Grok 3.5直接推出。它被定位为旗舰模型,有强大性能。马斯克欲用其写人类知识库,但引发争议。xAI融资100亿,建超算中心面临电力问题。

量子位
产品应用8

抛弃“级联”架构!快手OneRec用大模型构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
产品应用7

Claude Code、Cursor 可能都躲不过一次“大写”,但 OpenCode 也许是例外

文章指出Claude Code、Cursor等AI编程工具因开发方式问题,代码库陷入难逆转状态,或迎“大规模写潮”。而OpenCode强调代码一致性,代码库更干净。其创始人分享开发经验、工作流及对行业现象的看法。

InfoQ
开源动态8

里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节

蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数量达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。

机器之心
产品应用8

解密谷歌 NotebookLM 技术幕后【上】:知识如何被“转译”为 AI 对话式播客

NotebookLM是Google推出的AI知识工具,能将文档、网页等内容转化成笔记、播客、视频等。文章探秘其技术,解析AI音频播客与视频生成能力,还给出构建音频播客生成器的实践流程。

AI大模型应用实践
新闻资讯7

那位曾高喊「AI能接管一切」的CEO后悔了:宣布启人工招聘!

Klarna CEO曾称AI能取代所有人类工作,公司也实施‘AI优先’战略,用AI客服取代人类、缩减人力。但AI客服实际表现不佳,服务体验差,Klarna决定启人工招聘,打造‘高质量人类支持’。

AI科技大本营
算法论文8

舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿

本文介绍新加坡国立大学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。

机器之心