「通用验证器」共找到 1695 篇相关文章
Agent创业者的天塌了,OpenAI发布ChatGPT Agent
昨晚OpenAI发布ChatGPT Agent,这让Agent创业者紧张。它整合多种能力,功能强大,支持多操作。新模型经强化学习调优,在多基准测试中表现佳,或挤压初创公司通用Agent赛道空间。
ICML 2025|多模态理解与生成最新进展:港科联合SnapResearch发布ThinkDiff,为扩散模型装上大脑
现有扩散模型缺乏多模态推理创作能力,在算力和数据不充裕时实现该功能是难题。ICML2025上,港科联合SnapResearch提出ThinkDiff,以较少资源让扩散模型有思考能力,开辟多模态理解生成新路径。
前百川智能联创焦可新创业公司曝光,新项目已上线 App Store
前百川智能联创焦可新创业公司曝光,其推出的AI语音产品“来福”已上线App Store。该产品定位AI语音电台应用,探索声音交互场景,目前仅邀测。国内大厂未推专注AI播客独立产品。
OpenAI 高管凌晨发飙:「有人闯进我们家偷东西了!」
Meta CEO扎克伯格从OpenAI挖走四名高级研究人员,OpenAI首席研究官Mark Chen凌晨发飙,称像有人闯进家偷东西。Meta以1亿美元签约奖金挖角,OpenAI积极应对,还反思公司方向。
马斯克Robotaxi今日上路:画饼十年终兑现!团队合影C位武汉理工校友引关注
当地时间6月22日,特斯拉Robotaxi服务在美国奥斯汀南部启动,首批约10辆2025款Model Y运营。马斯克盛赞团队,AI团队合照C位是武汉理工大学校友段鹏飞,他是Autopilot关键技术负责人。
CVPR史上首次!中国车厂主讲AI大模型,自动驾驶也玩Scaling Law?
世界计算机三大顶会之一CVPR 2025落幕,小鹏汽车作为唯一受邀车企,其世界基座模型负责人发表演讲分享成果。小鹏用强化学习打造‘AI大脑’,还自研‘世界模型’,从云到端全流程优化,展现中国车企在自动驾驶的创新实力。
ACL'25 | CIGEval:一种基于多模态大模型的可控生图评测智能体
阿里国际AI团队提出CIGEval,这是基于多模态大模型驱动的图像生成评估智能体框架。它集成多功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。
200行python代码实现从Bigram模型到LLM
本文从`babygpt_v1.py`出发,逐步加入self-attention机制、position嵌入等,实现完整GPT。介绍Transformer结构,讲解位置编码、单头自注意力等机制的代码实现,还阐述后续层的用途、参数调整及训练效果,最后提及模型优化方向。
爆火论文颠覆RL认知!「错误奖励」让LLM推理暴涨24.6%,学界惊了
最新爆火论文颠覆传统RL训练认知,华盛顿大学等团队证实「伪奖励」可让LLM推理性能提升。研究设置多种伪奖励形式实验,发现其对Qwen模型有效,但并非对所有模型都有效。
文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”
港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。