「图像生成评估」共找到 2990 篇相关文章
独家|华为系帧跃科技完成千万美金天使轮融资,将发布视频产品 Leadde
AI 科技评论独家获悉,主攻 AI 交互式视频赛道的帧跃科技完成千万美金级天使轮融资。创始人杨昌鹏和联合创始人李明磊均有华为任职经历。公司提出‘三位一体’架构,2026 年下半年将发布产品 Leadde。
GitHub 已被各类Agent霸榜,今天挑选5个高star Agent
文章挑选5个GitHub高star Agent项目。如Hermes Agent是开源自改进AI Agent,有自主技能创建等特性;GitNexus是纯浏览器端代码智能工具;Shannon是白盒AI渗透测试工具等。
The Batch: 894 | 面向生物医学的多模态模型
过去几年联合推理模型进展快,但生物医学领域能力碎片化、脆弱或难解释。2026 年,学术界应推进多模态模型建设,关注深度整合、可解释性、数据效率和适应性及模型在工作流中的整合。
刚刚,ChatGPT Pulse上线!私人秘书不再是富人特权
OpenAI官宣ChatGPT Pulse上线,它改变LLM交互方式,从被动变主动。每晚研究,晨送简报,涵盖工作、生活、兴趣目标。其主动受用户控制,还给出三个试用场景。
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
大语言模型(LLM)到底是怎么运作的?(配图通俗讲解)
文章先介绍条件概率,指出大语言模型预测下一个单词是条件概率问题,会计算所有可能单词的条件概率选最高的。还提到直接选最高概率会使内容单调,引出温度概念,它能调整概率分布影响抽样结果。
谷歌·搜索:献给AI的第一个「祭品」?
谷歌正用AI重塑搜索,AI Overviews和AI Mode改变传统架构,从信息入口变终点,侵蚀开放网站流量。虽在AI创新有进步,但搜索广告垄断及商业模式岌岌可危,2026年或不复往昔。
NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026
本文整理了NVIDIA Research科学家李柏依在ECCV 2026 Workshop的分享,针对机器人训练数据采集壁垒高的问题,介绍了两项解决多模态感知与灵巧操作数据难题的前沿研究。
见微知著:LLM 奖励建模的「Analytic Rubric」范式全面综述
该文是对LLM奖励建模的「Analytic Rubric」范式的全面综述。介绍了Rubric概念来源,指出传统奖励模型存在对齐风险,而Rubric RM在多方面取得平衡,还阐述其工作流、各维度研究情况及面临的挑战。
Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台
Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,多Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。