代码执行模拟」共找到 2309 篇相关文章

算法论文8

“这个怎么组装?”一句无害的问题,如何让AI产生危险输出

Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。

深度学习自然语言处理
产品应用7

对话关梦龙:他想用 Agent 拯救你手机里的 100G 废片

前字节跳动剪映早期成员关梦龙,正开发AI编导产品“Cutto”,让AI参与内容生成,降低普通人创作门槛。他认为AI虽提升生产力,但创业竞争更激烈,产品成功需看用户能否持续使用。

AI科技评论
新闻资讯8

老黄秘密武器曝光:AI一夜设计芯片,顶人类顶级工程师10个月!

英伟达在GTC大会揭露用AI设计GPU,原本8名工程师10个月的任务,AI一夜完成。其开发NB - Cell、Prefix RL等工具,还推出内部大模型Chip Nemo和Bug Nemo,不过完全端到端自动化设计仍有距离。

新智元
算法论文8

VEGA-3D:释放视频生成模型中的隐式3D知识,重塑3D场景理解与具身交互

华中科技大学与百度联合提出VEGA - 3D,释放视频生成模型隐式3D知识。它将视频生成模型作‘潜在世界模拟器’,用自适应门控融合机制,提升场景理解等任务表现,无需额外3D标注数据。

机器之心
产品应用7

揭秘与评测 30K+ Star 的 Graphify:企业存量系统 AI 编码的"第二大脑"。

文章揭秘评测 30K+ Star 的 Graphify,它能将分散材料转为结构化知识图谱,助 AI 编程助手理解代码。介绍其使用方法、原理,经测试它能提升综合质量、降低探索成本,不过并非万能解药。

AI大模型应用实践
开源动态8

9.8K Star!谷歌开源神器 OSV-Scanner,一条命令扫出所有依赖漏洞!

文章介绍谷歌开源的轻量级命令行工具 OSV - Scanner,它能扫描项目依赖中的已知安全漏洞,连接项目依赖与 OSV.dev 数据库。支持多语言、多包管理器,有多种功能,可离线使用,还能提供修复建议和许可证扫描。

开源星探
产品应用7

神秘模型「大象」:仅100B拿下SOTA,Token效率超高!

神秘模型「大象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B大小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。

量子位
新闻资讯8

高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了

英国AI安全研究所研究显示,Anthropic发布的Claude Mythos Preview模型在网络安全评估中表现惊人,能全自动、全自主完成企业网络攻击模拟。高盛为此加强网络防御,人类网络安全或进入奥本海默时刻。

新智元
开源动态7

ESLint v10 发布,但有开发者已经在考虑换 Biome 了

广泛使用的代码检查工具 ESLint 发布 v10 版本,完成架构调整,移除旧版配置系统,改进查找配置文件方式等。但生态兼容性有问题,迁移成本高,部分开发者考虑换用 Biome 等替代工具。

InfoQ
新闻资讯8

程序员都在给AI当“监工”!7万多条编程消息揭开当前编程现状

圣母大学和范德堡大学研究团队剖析超7万条编程指令,揭示开发者与AI编程助手协作现状。开发者多当“监工”,工作从敲代码转向指导AI、诊断错误等,还总结出人机协同的诸多规律。

AIGC开放社区