「生成式奖励模型」共找到 8885 篇相关文章
复旦北大联合美团LongCat提出TDAR:用“粗思考,细求证”破解Block Diffusion的速度精度悖论
复旦大学、北京大学联合美团LongCat提出Block Diffusion推理模型Test-Time Scaling新框架TDAR,引入‘粗思考,细求证’范式与有界自适应置信度解码,打破速度与精度零和博弈,在多基准测试表现出色。
我们给OpenClaw加了一双眼睛,来观察我们这平凡的一天。
内容创意组小伙伴用Pocket 3作OpenClaw的“眼睛”,俯拍工位区,截取图片喂给多模态模型描述场景,下班时让OpenClaw分析趣事。还开发了“OpenClaw人类观察计划”,开发过程简单,降低了Agent体验门槛。
GLM-5真够顶的:超24小时自己跑代码,700次工具调用、800次切上下文!
GLM - 5正式发布,把开源AI带入长任务时代。它超24小时自己跑代码,完成GBA模拟器,能力稳定。评测结果佳,在主流测试中编程能力与Claude Opus 4.5对齐,引发网友欢呼。实测还展现多种应用能力。
AI 硬件新物种:七位从业者对消费级 AI 硬件的答案
2026 年 CES 落幕,释放中国 AI 硬件集体出海信号。蚂蚁集团等主办的活动上,7 位从业者分享消费级 AI 硬件产品,涵盖养成宠物、智能戒指等。他们认为 AI 硬件竞争焦点正从模型能力转向场景理解。
就业恶化AI不背锅!经济大周期下AI取代的技能依然很重要
研究表明就业市场恶化早于生成式AI普及,高AI暴露职业失业风险在2022年初就上升。毕业生求职困境源于宏观经济周期,且掌握与AI能力重叠技能,在后ChatGPT时代反而能提升起薪、缩短求职期。
红杉对话 LangChain 创始人:2026 年 AI 告别对话框,步入 Long-Horizon Agents 元年
红杉访谈 LangChain 创始人 Harrison Chase,探讨 Long-Horizon Agents。其认为 2026 年是 Doers 元年,这类 Agent 能处理长时程任务。还提及 Harness 架构、Coding Agent 等,指出 Memory 是壁垒,交互需同步与异步结合。
刚刚,DeepSeek又探索新架构了,开源OCR 2
DeepSeek更新DeepSeek - OCR 2,引入DeepEncoder V2架构,实现视觉编码范式转变。模型和技术报告齐开源,在多项测试中表现出色,降低重复率,为全模态编码提供路径,但在报纸类文档识别有不足。
飞猪搭建系统演进:从人工运营到多Agent协同搭投生产
飞猪移动端页面搭建体系从初代寄生于阿里集团平台,发展成“搭投”体系。但传统人工选搭投模式待优化,为此启动AI智能搭投升级专项,构建新范式,还介绍产品结构、技术实现及后续规划。
DeepSeek-R2要来了?
DeepSeek-R1发布一周年之际,其存储库更新引用全新「model 1」模型,极可能是R2。HuggingFace发文称R1降低技术、采用、心理三重壁垒。R1以推理优先,改变多项认知,故事仍在继续。
马斯克刚刚真把 𝕏 平台推荐算法给开源了,核心也是Transformer
𝕏平台(原Twitter)将全新推荐算法开源,由与xAI的Grok模型相同的Transformer架构驱动。该算法预测用户行为对帖子排序。此前平台因算法问题被调查和罚款,开源或有此原因。