生成式任务」共找到 4169 篇相关文章

算法论文8

同时监督和强化的单阶段大模型微调,告别“先背书再刷题”,推理泛化双提升|中科院&美团等

中国科学院自动化研究所联合美团提出单阶段监督 - 强化微调方法 SRFT,结合监督微调与强化微调,解决传统两阶段方法的不足,在多任务中提升推理和泛化能力。

量子位
推荐文章7

99%的人都不知道:MCP 必须在 Claude Code 外面装

作者分享飞书MCP安装经验,指出MCP要在Claude Code外安装,介绍用Cursor生成安装命令、验证安装、删除服务等技巧,还整理《MCP安装指令文档》,复制粘贴就能用。

AI 产品自由
开源动态8

什么情况,一夜之间冲上热搜,狂揽29.6k星,再见吧SQLite!这个嵌入分析引擎实在太香了

DuckDB是嵌入OLAP数据库,被赞“分析型SQLite”。它采用列存储和向量化查询引擎,性能佳,功能多,适合探索性数据分析等场景,能替代Pandas等,成本低。

小华同学ai
产品应用7

Sora 为什么输给 Codex?

本文探讨Sora输给Codex的原因。奥特曼称因Sora太吃compute,Codex优先级更高。Sora算力连续独占,成本难摊薄;Codex算力碎片可复用,能交错服务多任务,资源回报曲线更好。

AI科技评论
新闻资讯7

大模型年中报告:Anthropic 市场份额超 OpenAI,开源模型企业采用率下降

本文基于年中报告指出,当前模型API支出翻倍,企业重心转向模型推理。Anthropic市场份额超OpenAI,开源模型企业采用率下降。代码生成成热门场景,企业换模型重性能,AI支出从训练转推理。

Founder Park
算法论文8

扩散语言模型九倍推理加速!上海交大:KV Cache并非自回归模型的专属技巧

上海交通大学EPIC Lab团队提出免训练推理缓存机制dLLM - Cache,复用特征降低计算量。它即插即用,通用于主流dLLM架构,在多个基准测试中实现数倍推理加速,且不降低生成质量。

量子位
产品应用7

Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台

Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,多Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。

phodal
推荐文章8

Agent失忆怎么办,Anthropic教你做好工作交接

文章指出AI Agent跨上下文窗口执行长任务时易失败,Anthropic用Opus 4.5实验发现,问题根源是交接差。解决办法是让Agent像人类工程师一样留文档、进度和测试,拆分流程,严格规范,提升测试覆盖率。

CourseAI
开源动态8

本周 5 个火火火的Github开源项目,太香了!

文章介绍了本周5个热门GitHub开源项目。有能生成城市地图海报的MapToPoster,离线翻译工具Argos Translate,终端历史增强神器Atuin,轻量超高效版OpenClaw的PicoClaw,以及开源轻量级文本转语音工具Pocket TTS。

开源先锋
开源动态7

阿里最新开源王炸Agent!性能全面SOTA!

阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方

探索AGI