图像理解与生成」共找到 2986 篇相关文章

开源动态8

从3632个漏洞看AI时代的评测基准重构!VulnGym基准发布

随着新一代漏洞检测工具出现,漏洞检测走向理解业务风险。腾讯悟空安全团队联合多机构发布 VulnGym 评测基准,基于真实漏洞构建,覆盖 400+ 漏洞路径,71.2% 为业务逻辑漏洞,支持确定性评测。

腾讯技术工程
新闻资讯8

留给人类数学家的悬赏不多了!谷歌DeepMind一口气解决9道埃尔德什问题

AI进军数学界速度惊人,谷歌DeepMind发布由Gemini驱动的AlphaProof Nexus框架,解决9个埃尔德什开放问题,还证明44个猜想、搞定代数几何难题、改进凸优化理论边界,推理成本低且代码开源。

量子位
产品应用8

X-Era蝉联双榜单冠军,引领世界模型未来方向

X-Era的EonWorld在WorldScore和WorldArena两个榜单上连续霸榜。它来自X-Era的VWA原生世界动作模型体系,本职是帮机器人预判世界变化。这为“可用于行动的世界模型”竖起能力线,也揭示行业正进入新阶段。

AI科技评论
开源动态8

35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。

GiantPandaLLM
新闻资讯7

CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性

云原生计算基金会(CNCF)指出,企业在 Kubernetes 上部署大语言模型(LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。

InfoQ
开源动态7

一个CLAUDE.md霸榜GitHub第一!蒸馏自Karpathy,6万码农抄作业

一个名为CLAUDE.md的Markdown配置文件冲爆GitHub,本周新增44,465颗星,总星数61.6k,连续三天Trending日榜第一。它源自Karpathy对LLM编程陷阱的观察,含四条规矩,能约束AI编程Agent。

新智元
算法论文8

RAG搜对了却答错?德国萨尔大学找到了真相丨ACL'26

RAG是大模型落地标配技术,但存在搜到文档却答错的痛点。德国萨尔大学等团队提出Disco - RAG框架,在‘搜’和‘答’间加入‘读懂’环节,已被ACL 2026主会录用,在多基准测试表现优异。

量子位
算法论文8

分享2篇最新Harness论文,一篇谷歌,一篇微软

在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。

PaperAgent
新闻资讯7

字节Seedance 2.0发论文了,171人署名,吴永辉曾妍在列

现象级AI视频技术字节Seedance 2.0在arXiv发论文,公布26页Benchmark和170位贡献者名单。此时它正通过Byteplus平台铺向全球,支持多模态输入。该模型突破瓶颈,评测表现优异,团队近半换血。

量子位
新闻资讯8

斯坦福2026 AI指数报告!中美差距已实质性抹平

斯坦福HAI发布2026年度人工智能指数报告,显示中美在顶级大模型性能上差距已实质性抹平。报告还呈现了AI能力进化、算力格局、智能边界、安全监管、人才流动等多方面情况。

AIGC开放社区