「预训练模型」共找到 8295 篇相关文章
从性能到实战,怎样才算是靠谱的 Agent 产品?
红杉中国团队提出AI基准测试工具Xbench,其双轨测评体系不再单纯执着于测评问题难度,重点量化AI系统在真实场景的效用价值,还构建长青评估机制,以确保评估结果的时效性和相关性。
AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响
Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。
北大DeepSeek论文或预定ACL Best Paper!梁文锋署名
北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是长文本处理的突破。此外,张铭教授团队还有多篇论文上榜。
CAI+DeepSeek渗透测试情况及扩展分析
文章对CAI+DeepSeek进行渗透测试。介绍CAI安装,在kali按Ubuntu指令装,使用界面友好。测试中CAI执行指令彻底灵活,扫描分析到位。还提及CAI多种能力,称其作为开源框架全面细致,值得研究。
豪掷30亿美元,OpenAI史上最大收购案!
彭博爆料OpenAI将豪掷30亿美元吞并AI编程工具Windsurf,这是其史上最大规模收购。Windsurf因模型无关性设计等优势脱颖而出,此次收购或重塑AI编程市场格局。
Cloudflare CEO:五年后,机器人流量将千倍于人类
本文整理自The Verge《Decoder》播客对Cloudflare CEO的访谈,披露今年5月互联网自动化流量已超过人类流量,预测五年后将达千倍,讨论AI时代互联网新商业模式、内容付费、AI爬虫拦截等热点议题。
万星skill作者:用Opus 5.5,先把视频skill卸载了
本文分享了GitHub万星项目video-shotcraft作者Vincent的最新观点,Opus 5.5仅需一句话就能生成包含BGM、音效的完整视频,无需额外视频制作skill,引发对AI技能价值的讨论。
Claude Opus 5.5 到底强在哪?大幅降价后谁会受影响?
本文从工程视角拆解Anthropic新品Claude Opus 5.5,分析其能力升级、定价调整,分享开发者实测案例,解读此次升级对AI行业格局的影响。
DeepSeek Harness 保姆级教程:安装配置、模式详解、Token消耗&竞品对比
本文是DeepSeek Harness的保姆级教程,从零讲解这款开源AI Agent运行框架的核心特性、安装部署、功能模式、Token消耗机制,横向对比主流竞品给出选型建议,新手也可快速上手。
智能体请求暴增 9.4 倍,token 账单却没涨:Uber 公开 AI 软件工厂省钱方法
AI 工具已嵌入 Uber 软件开发各阶段,智能体请求量增长 9.4 倍,但 AI 总支出自 4 月相对稳定。文章介绍其软件工厂思考,包括智能体会话层级、成本公式、指标测算及优化手段,还提及未来举措。