静态人物图」共找到 408 篇相关文章

新闻资讯7

AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。

作者和同事测试AI色盲测试,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看断章取义,缺乏人类的“格式塔”能力。

数字生命卡兹克
算法论文8

40年首次突破!清华大学发布全新最短路径算法,打破理论瓶颈:数据中心有望节省大量计算资源

清华大学Ran Duan、Longhui Yin团队发表论文,提出确定性新算法,在稀疏上表现超经典Dijkstra算法。新算法时间复杂度为`O(m log²/³ n)`,不维护全局有序顶点队列,应用前景广,可节省计算资源。

AI寒武纪
开源动态8

GitHub连续霸榜,难怪别人的表这么高级优雅!

作者让AI画系统架构效果不佳,朋友推荐diagram-design项目。它是给Agent用的出技能包,能让AI生成编辑级质量表,有多种表类型,具备诸多亮点功能,还介绍了安装使用方法。

开源先锋
产品应用7

LibTV这个邪修功能,大大减少AI视频抽卡次数!

作者分享在LibTV用「深度动作捕捉」功能做AI视频,将视频动作提取成深度,可减少AI视频生成失败率,且不花积分,深度管几何,提示词管外观,提一次能用多次。

花叔
产品应用7

藏师傅教你用 Nano Banana 编辑片做手办

前几天发 Nano Banana 测评后,很多人不知怎么用。刚好做手办玩法火了,作者教大家在 LM Arena 用 Nano Banana 编辑片、做手办,还介绍把片变视频及剪辑的方法。

歸藏的AI工具箱
开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了

OpenHands 等团队发布 LocAgent,这是用于代码定位的索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
新闻资讯7

Sora终于开放上传真人照片生成视频了

本周起,符合条件的Sora用户可上传含人物照片制作视频,使用前需声明获人物同意。这是Sora受期待功能之一,有严格限制,且照片转视频功能审查更严,此为OpenAI平衡之举。

AI工程化
算法论文8

ACL'25 | 多智能体叛变进行中?首个多智能体安全守卫G-Safeguard亮相!

随着基于LLM的多智能体系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于神经网络,通过构建多智能体话语等方式,能有效抑制恶意信息传播,有强大防御和泛化能力。

PaperAgent
新闻资讯7

5月半导体产业涨价信息全景

2026年半导体行业涨价潮席卷全产业链,受AI超级周期与上游金属成本高企影响,存储芯片、MCU等器件及代工、封测服务等均涨价。文章梳理开年至今行业涨价信息,还分析原因及对终端市场的影响。

芯师爷
算法论文8

Relink:为GraphRAG动态构建证据

大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。

PaperAgent