验证流程」共找到 1541 篇相关文章

新闻资讯7

OpenAI「GPT门」事件引爆!Plus、Pro账户统统降配,偷换模型全网实锤

OpenAI被曝在用户不知情下,将GPT-4、GPT-5等模型路由至低算力敏感模型,引发用户对选择权和付费权益质疑。该现象已在社交媒体广泛验证,OpenAI回应称是在测试新安全路由系统。

新智元
新闻资讯7

Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题

OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。

Founder Park
产品应用8

这个 AI 产品,给了我久违的惊喜。

作者曾探讨为何此前无出圈客服 Agent 产品,认为做 Demo 易,生产环境可用门槛高。本周阿里瓴羊团队发布企业级客服 Agent,它能处理退款、补发等流程,采用人机分工模式,务实靠谱,有望改善客服行业现状。

MacTalk
新闻资讯7

「2025 AI 实战手册」,年收入破亿的 AI 公司都在干什么?

硅谷 ICONIQ Capital 团队发布 2025 年度「The State of AI」报告,围绕 AI 产品落地,通过问卷收集 300 家 AI 公司高管回答,从开发、定价等五方面剖析 AI 产品端到端流程,还对比了 AI 原生和赋能型公司产品发展。

机器之心
算法论文8

从打分器到思考者:RM-R1用推理重塑模型价值判断

伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。

机器之心
产品应用7

再见Bug!谷歌超级编码智能体Jules上线,免费使用直连GitHub

谷歌推出编程智能体Jules,进入全球测试阶段,有Google账户的开发者可免费试用每日5次。它基于Gemini 2.5 Pro模型,能写代码、修Bug等,还可连GitHub简化流程,预计今年晚些时候推更多功能和企业版。

新智元
算法论文8

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。

量子位
开源动态8

谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜

在大模型竞争白热化背景下,谷歌为解决开发者难题推出 Agent Skills。官方仓库含多项技能,涵盖谷歌云核心服务及架构支柱技能,还提供常见任务流程指南,兼容多平台,能省开发代码。此前还有 Addy Osmani 开源的技能库。

InfoQ
产品应用7

对话小鹿光年创始人许婷:超七成付费人群是子女,AI回忆录的「隔代」生意经

本文是对小鹿光年创始人许婷的访谈。许婷介绍了AI回忆录产品小鹿光年,称超七成付费人群是子女。还谈及产品流程、优势、用户画像等,也分享对赛道发展的看法,认为创业者晚几年入局或更合适。

AI科技评论
开源动态8

清华开源教育龙虾,沉浸式互动课堂,运行成本仅为传统的千分之一

清华大学团队将校内验证两年的AI课堂系统OpenMAIC开源。它能把主题或文档转化为互动课堂,运行成本仅为传统MOOC的千分之一。有多种组件,多智能体协作,还支持多种大模型,已获学生积极反馈。

AIGC开放社区