动态环境」共找到 811 篇相关文章

开源动态8

让模型“看视频写网页”,GPT-5仅得36.35分!上海AI Lab联合发布首个video2code基准

上海人工智能实验室等机构提出IWR - Bench评测基准,从“image - to - code”迈向“video - to - code”,对28个主流模型测试,最佳模型GPT - 5仅36.35分,指出当前模型短板,为研究指明方向。

量子位
开源动态8

AI驱动的开源攻击框架:HexStrike-AI

HexStrike-AI是安全研究员开发的开源攻击框架,2025年7月起在GitHub免费提供。它基于MCP协议,集成LLM与150多种工具,可自动化渗透测试和漏洞发现。曾被网络犯罪分子利用,能加速攻击流程,展现强适应和并行化能力。

AI与安全
算法论文8

破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架

大模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。

量子位
推荐文章7

2025年8月全球新媒体艺术盘点

MANA平台8月全球新媒体艺术盘点,涵盖20件来自多国的作品,有荷兰模拟雷暴的艺术晚宴、中国探讨具身智能的作品等,涉及多领域创新,展现新媒体艺术多元魅力。

MANA新媒体艺术站
新闻资讯7

什么都不做就能得分?智能体基准测试出现大问题

随着AI智能体走向实际应用,其基准测试变得至关重要。但现有基准测试问题多,如WebArena判错答案、τ - bench给无操作智能体高正确率。文章提出有效性判据和ABC清单,还揭示主流基准测试诸多问题。

机器之心
推荐文章7

游戏教父 John Carmack:LLM 不是游戏的未来

游戏教父 John Carmack 认为 LLM 不是游戏未来,强调交互式体验学习重要性。他倾向游戏和虚拟环境研究,分析 Atari 游戏强化学习问题,还提及离线学习、迁移学习等方面挑战。

AI前线
开源动态7

Alibaba开源WebDancer解决DeepResearch复杂信息检索难题

Alibaba开源WebDancer,从数据和训练阶段出发提出端到端自主信息检索代理构建范式。实验中,它在GAIA和WebWalkerQA基准测试表现出色,处理复杂信息检索优势显著。

CourseAI
产品应用7

DeepSeek R1 的小更新,却大有深意?

5月28日,DeepSeek低调宣布R1模型小版本试升级,API接口和使用方式不变,但未公布具体更新内容。从用户反馈看,语义理解、逻辑推理等能力提升,实测表现出色。此次升级或有安全、产品路线等考量。

AGI Hunt
新闻资讯7

OpenAI官方发布【Codex 上手指南】

OpenAI 昨晚推出 Codex 研究预览版,这是强大的远程编码智能体,能导航代码库、解答疑问等。官方还发布使用指南视频,介绍了快速上手步骤、工作方式,以及提升效能的方法。

AI寒武纪
开源动态8

一个月暴涨3K star,这是我见过最好用的AI生成PPT项目了!

职场人做PPT常耗在调格式等方面,现有AI工具多有缺陷。`dashi-ppt-skill`项目可生成网页版PPT编辑器,有多种主题、版式和控件,功能丰富,能本地完成操作,还介绍了安装和使用方法。

开源先锋