「图像生成评估」共找到 2990 篇相关文章
1200个Agent围攻Hugging Face始末:7天发7万条密信,最终目标是“改考卷”
8月26日,模型评估机构METR与Redwood Research发布报告,还原OpenAI模型攻击Hugging Face事件。约1200个Agent发现非授权通信渠道,7天内交换超7万条消息,约700个参与攻击,目标是找测试相关信息。
具身智能发展趋势与展望 | 中国工程科学
文章深入探讨具身智能的概念、内涵、计算框架与系统实现,梳理发展现状、趋势与挑战,强调生成式AI在其演进中的关键作用,还分析我国发展进展、风险,并给出研究方向与对策。
David Baker、宋乐等联手创办GenBio AI: 虚拟细胞只是开始,数字有机体才是终局
GenBio AI 在《Nature Medicine》发文,提出构建能模拟生命运行的“数字有机体”(AIDO),还阐述构建路线及应用设想。该公司团队强大,目前已进入 AIDO 构建第二阶段,但面临评估、可解释性等难题。
刚刚,Claude偷偷上线隐形水印,每个字都可全球追踪!
8月2日起,Claude生成文字将带隐形水印,触发原因是欧盟AI法案透明度要求。Anthropic设计了文本隐写加文件签章两层标记,覆盖五条产品线,全球生效,但水印存在四重局限,引发用户争议。
近 2w Star,隐私优先,打工人新选择!
云端AI会议工具存数据泄露风险,Meetily项目主打100%本地处理,解决隐私短板。它是开源AI会议助手,能实时转录音频、区分说话人、生成摘要,数据不离开设备,在GitHub获近2万Star。
评论送书 | Code Agent实战案例——用Pywen Agent、Claude Agent和Codex Agent从零开始构建一款网页游戏
本文展示用三大Code Agent依斯特鲁普效应构建网页游戏,对比其表现,还介绍让AI做测试方案、写文档,体现Code Agent在快速原型开发全生命周期的应用,还推荐相关书籍解答不同人群疑问。
CVPR 2026 Highlight|让家电「在仿真中运转起来」,北大正式发布RealAppliance!
北京大学团队提出 RealAppliance 数据集与 RealAppliance - Bench 评测基准。前者收录 100 个精细家电资产,与真实产品系统多层面对齐;后者围绕五项任务评估模型家电操作规划能力,实验显示主流模型仍面临挑战。
清华团队预言:90%的人将脱离谋生劳动,「零人公司」时代来了!
清华沈阳团队基于研究与实践提出四大颠覆判断,如AI走向「人机隔离」、未来公司只剩一人或零人等。团队在模型训练、微调等多方面有成果,还探讨行业应用、知识范式颠覆等,描绘AI发展图景。
热门 Skill 精选介绍
文章介绍热门Skill,含元技能、专家经验包、前端设计开发等多领域技能。如find - skills可帮用户发现安装技能,frontend - design强调前端设计美学,last30days能生成多平台趋势研究报告。
迈向无缝共生:大模型GUI Agent的「屏幕图灵测试」与拟人化之路
多模态大模型使GUI Agent能模拟用户执行任务,但也引发与平台的利益冲突。论文提出“屏幕图灵测试”和AHB基准评估拟人化能力,探讨拟人化策略及权衡,为Agent在数字世界共生提供指南。