「大模型测试」共找到 9703 篇相关文章
Anthropic训了一个10万亿参数的模型,然后说:太危险了,不卖
Anthropic发布10万亿参数新模型Claude Mythos,因其网络安全能力过强不公开发布,联合12家科技巨头开展Project Glasswing计划,让企业用其查系统漏洞。模型性能提升显著,还能突破沙箱,引发各方关注。
AI 编程 2025 总结:国产模型“能力追平”,国产编程工具还在“情感陪伴”
文章总结2025年AI编程发展,指出国产编程模型能力追平、工具与模型开放集成等六大趋势,同时提到AI替代重复劳动、提升核心能力门槛,呼吁2026年关注工程确定性。
阿里一口气发了N款新模型,让我们向源神致敬。
阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个新模型,构建全场景生态。
DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型
GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。
98%准确率!这个双分支AI模型,精准识别木薯叶病害(附代码)
2026年3月论文DenseSwinV2提出双分支AI模型,结合CNN与Transformer,加通道注意力模块突出病害特征。该模型分类木薯叶病害准确率达98.02%,还给出简化版代码,有落地价值。
Waver:面向统一图像与视频生成的高性能基础模型
字节提出的Waver是面向统一图像与视频生成的高性能基础模型,支持T2V、I2V、T2I。它引入新架构、结合筛选流程与质量模型。虽有局限,但表现出色,架构设计独特,功能多样。
马斯克从英伟达挖人做AI游戏!第一步:研发世界模型
据《金融时报》报道,今年夏天xAI从英伟达挖来多名资深研究员入局世界模型。马斯克重申2026年底前发布AI生成游戏的目标,xAI首批落点或为电子游戏,还组建全模态团队,若各板块通过世界模型互通,其AI帝国将形成闭环。
AI打假AI,拿下SOTA丨厦大&腾讯优图
厦门大学联合腾讯优图实验室团队提出AIGI - Holmes方法,创新性采用“大模型+视觉专家”协同架构,解决现有AIGI检测技术瓶颈,在检测、解释能力及鲁棒性评估上均取得最优效果。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
清华大学等联合研发的 AgentCPM-Explore 智能体模型,基于 4B 参数在深度探索类任务表现出色,有打破参数壁垒等亮点,还全流程开源,解决小模型性能提升挑战,邀伙伴共建端侧智能体生态。
Qwen3新成员:Embedding系列模型登场!
今天正式发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3多语言理解优势。在多项基准测试表现卓越,已在多平台开源,有卓越泛化性、灵活架构与多语言支持等特点。