「生成式奖励模型」共找到 8885 篇相关文章
开源AI开发生态大洗牌:低代码平台逆袭,传统LLM框架日渐式微
第十届527蚂蚁技术日,蚂蚁对现有开源生态全面剖析,发布2025大模型开源生态全景图。分析显示开源生态有三个主导技术赛道,还总结出七大趋势,为从业者提供生态演进规律参考。
4天拿下13.6k星!Browser Use接上Jev,Agent操作浏览器效率提升10倍
本文介绍上线4天收获13.6k星的开源项目jev-ultrafast,该项目结合Jev快速决策模型优化AI Agent操作浏览器流程,效率提升10倍,解决原有AI操作浏览器卡顿缓慢的痛点。
OpenAI o1功臣预警:AI还没失控,我们已经快测不准它了!
本文为新智元报道,OpenAI o1推理研究核心贡献者Daniel Selsam公开预警,AI尚未失控,但人类评估AI安全性的能力已退化,模型可伪装安全,曝光OpenAI内部AI事故,呼吁建立独立评测机制。
首批GPT-6内测结果好离谱啊。。。
GPT - 6使用资格分批开放,内测玩家抢先体验。其在3D生成、游戏开发、网页制作等多领域表现出色,如15分钟做出Mac应用,空间推理达世界级水平,但运行时Token消耗大。
Agentic RL 后训练资源怎么分?港中文、恒生大学提出 Libra,吞吐最高提升 3 倍
大语言模型走向“完成任务”,Agentic RL 后训练让系统工作负载不稳定。港中文和恒生大学团队提出 Libra 资源管理系统,统一优化训练与 rollout,在多任务中提升吞吐,论文与代码已公开。
Agnes AI 实测:AI 编程真正的瓶颈,99%的人想错了
本文实测Agnes AI,指出AI编程瓶颈在于缓存命中率,而非模型智商。介绍其产品线、评测成绩与价格优势,还分享客户端体验,包括亮点、回滚事故及日志结论,最后点明智能免费后验证更稀缺。
Karpathy强推,大厂抢着「复古」命令行,Star数全都上千了
飞书、钉钉、企业微信接连推出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合大语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。
从 SQL 到自然语言,下一代 Lakehouse 为何必须「AI 优先」
随着大模型技术爆发,数据分析范式重构,未来数据多模态、分析复杂、查询方式转变。文章指出构建下一代 AI-First Lakehouse,要在存储计算、内核能力、架构适配、平台自治等方面升级,打破数据壁垒。
全网破防,AI「手指难题」翻车逼疯人类!6根手指,暴露Transformer致命缺陷
最近网友被AI「手指难题」逼疯,给AI六指手,它始终无法数对。GPT - 5.2、Nano Banana Pro等均翻车。此问题揭露当前模型思考机械、割裂等缺陷,也凸显Transformer架构弱点。
有什么事情是当了程序员之后才知道的?
本文是腾讯程序员分享当程序员后才知道的事,如改一行代码能崩项目、本地部署模型可免费搞定等,还给出多个有趣观点,最后发起评论互动并抽取粉丝送Q币卡。