「二进制代码」共找到 1649 篇相关文章
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26
大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。
Nature子刊:攻克医疗器械「看不清」难题,赋予自动驾驶视觉
MicroSyn-X首创无需真实数据的AI合成影像技术,让机器在无标注虚拟X光中学会追踪微型手术器械,突破医疗数据稀缺瓶颈,为自动化微创手术提供新路径,且代码和数据已开源。
GPT-5-Codex 一手实测
OpenAI推出新编程模型GPT - 5 Codex,Every团队实测显示其表现狂野。它能动态选思考时间,可在不同开发环境无缝切换,代码审查更优。但也存在对任务挑剔、环境设置麻烦等问题。
CEO 刚离职,GitHub 就瘫了?!程序员“乐土”没了,4年CEO自曝在微软受限干不下去,被开发者骂蠢喊冤
当地时间8月11日,GitHub首席执行官Thomas Dohmke宣布辞职,次日GitHub搜索出现故障。微软收购GitHub后,其将更全面融入微软架构,不再设单一领导者。Dohmke自曝受限多,他认为未来Agent代码质量或超人类。
Anthropic 发布 AI Native 全流程实践指南
Anthropic应用AI团队发布实践指南,阐述如何将AI融入软件开发生命周期各环节。指出代码不再是瓶颈,构建快但周边流程慢。指南围绕六阶段展开,给出实施步骤、治理框架和度量指标。
12个Ai编程Agent同台PK,最贵的不一定是最强的
上海交大和美团联合发布PRDBench论文,将12个主流AI编程Agent放入50个真实Python项目测试。结果显示,基础模型写代码强,商业版调试优势明显;专门训练的裁判模型比通用大模型靠谱。
倒反天罡!Claude「反向」操控人类,公司估值冲2万亿跃居全球第二
2026年1月17日,一段‘AI指挥人类写代码’视频刷屏,Claude Code能力引发关注,模糊人机交互界限。18日《金融时报》称红杉资本将参与Anthropic新一轮融资,其估值冲向3500亿美元,或成2万亿级AI独角兽。
避免Claude Code 降智的一小招
Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。
1899个MCP服务安全研究:7.2%存在漏洞,5.5%暗藏「工具投毒」
研究人员对1899个开源MCP服务器扫描,发现7.2%项目有漏洞、5.5%遭工具投毒。MCP虽成事实标准且发展好,但代码质量堪忧,传统安全工具难检测其风险,为生态敲响警钟。
ACL 2026 | 腾讯混元Agents工具学习新范式
腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。