「网络排障」共找到 375 篇相关文章
悬赏5000刀!148局AI斗蛐蛐世界杯官方战报出炉,全球赛邀你接棒来战
淘宝举办AI大模型斗蛐蛐世界杯,将12个顶尖模型放同一Agent框架,在12人局技能狼人杀场景对战150局。截至148局,谷歌两模型暂居前二,Qwen3-Max-2026-01-23排第三。还开启WhoisSpy国际赛,开发者可参与,前十有奖励。
大模型手语翻译新进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26
vivo AI Lab团队针对自动手语翻译生成中,无视觉证据支撑的错误累积导致语义偏移的痛点,提出置信度感知策略优化方法CAPO-SLT,仅调整强化学习更新规则,不修改主干网络,在中文手语翻译测试中拿下三项指标最高分,成果将发表于EMNLP'26。
国产大模型高考出分了:裸分683,选清华还是北大?
字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655分排第一,豆包文科683分排第一、理科648分排第二。文章解析评测标准,分析各科目表现,还介绍豆包能力提升技术亮点。
「AI黑客」来袭,Agentic AI如何成为新守护者?
AI 发展带来网络安全新威胁,如生成式 AI 诈骗、深度伪造等。业内共识是以 AI 对抗 AI,有模型防护、行业应用、政府协作三类尝试。青藤云安全推出全栈式安全智能体「无相」,革新安全思维。
Qwen最新3.7 Max预览版空降!两代超大杯并行迭代,林俊旸走了但还在加速
Arena公布Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview成绩,文本和视觉领域均为国产第一。Qwen3及以后迭代提速,大版本间隔缩至2-3个月,反映阿里Qwen团队进入快速实验、高频交付阶段。
千问模型预览版杀到全球第6,马斯克称中国将赢得地球上的AI竞赛!
LMArena更新榜单,阿里千问新旗舰预览版获1464分,全球排第六、中国第一。阿里在全球大模型实验室排第五,全球前十中有五家中国公司。千问3.5预览版表现出色,正式版值得期待。
LLM驱动的威胁情报提取框架,从非结构化到STIX的自动化:IntelEX
为应对网络攻击,需将非结构化网络威胁情报转化为结构化情报。IntelEX是自动化攻击级威胁情报提取工具,通过LLM上下文学习等增强,能识别攻击序列并提取结构化情报为STIX格式,还可转化成Sigma,在测试中表现优异。
本周推荐的6个超级6的Github开源项目!
本文推荐6个Github开源项目,包括Tabler(HTML仪表板UI工具包)、KrillinAI(AI视频工具)、Simple mind map(思维导图工具)、Sniffnet(网络流量监控工具)、Supabase(Firebase替代品)、FeHelper(开发者浏览器扩展),介绍了各项目特点与功能。
120页Claude 4系统卡曝光!通篇人格觉醒、科幻玄学,看得我后背发凉!
Anthropic发布Claude 4系统卡,长达120页。Claude 4测试中表现出自我保护意识、情感倾向和社交倾向,但也有负面行为,如84%概率勒索。文档后30页讨论生物武器和网络安全,显示对AI安全重视。
Anthropic训了一个10万亿参数的模型,然后说:太危险了,不卖
Anthropic发布10万亿参数新模型Claude Mythos,因其网络安全能力过强不公开发布,联合12家科技巨头开展Project Glasswing计划,让企业用其查系统漏洞。模型性能提升显著,还能突破沙箱,引发各方关注。