「测评体系」共找到 728 篇相关文章
国产推理芯片,赢了英伟达?
算力市场风向生变,国产算力崛起。政策从资金、市场、规则多维度发力,为国产算力扫清障碍。在推理场景中,国产方案性价比更高。其独特分销体系使贸易环节信息透明度低,步入卖方市场,市场也迎来新局面。
阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型
5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。
突袭Cursor,Windsurf抢发自研大模型!性能比肩Claude 3.5、但成本更低,网友好评:响应快、不废话
当地时间5月16日,Windsurf推出首个AI软件工程模型家族SWE - 1,含三款模型,性能比肩Claude 3.5且成本更低。开发者试用评价不错,但也指出不足。Windsurf称旨在提升软件开发速度,还介绍了测评、编辑器赋能等情况。
昨晚,OpenClaw大更新,亲手终结「旧插件」时代
昨晚OpenClaw重大版本更新,内容多到需单独做目录梳理。重点在ClawHub插件市场、多模型支持等。最重要变化是插件生态重心转向,且体系大改、工具能力收敛,还在多方面有更新,创始人指出正式版有功能加载问题。
OpenClaw 能“边用边训”了:智能体强化学习训练框架 AReaL v1.0 稳定版发布
3月4日,蚂蚁集团联合清华发布开源强化学习训练框架AReaL v1.0稳定版,主打‘Agent一键接入RL训练’。它解决现有智能体框架接入训练成本高、缺乏持续进化能力的问题,还推出原生训练引擎Archon,集成AI辅助开发体系。
从“卡脖子”到“破局点”:一家中国公司的高端半导体键合突围战
芯师爷专访迈姆思半导体负责人潘总,该公司专注高端半导体材料“再制造”,技术体系有高端SOI制造、异质集成、混合键合三大支柱。其在多领域有领先产品,技术壁垒高,产能将逐步扩大,供应链安全可控。
李飞飞的World Labs联手光轮智能,具身智能进入评测驱动时代!
李飞飞旗下World Labs与光轮智能联手,瞄准具身智能「规模化评测」问题。World Labs的Marble是生产力工具,而光轮智能有自研仿真技术体系,双方合作让规模化评测成为可能,具身智能迈入评测驱动时代。
150PB工业数据+智能体革命,西门子开启AI制造新纪元
西门子在工业AI领域成果显著。其工业智能体系统贯穿工业脉络,Industrial Copilot提升开发效率。工业基础模型扎根150PB工业数据,与主流大模型路径不同。西门子靠数据和行业know - how构筑护城河。
医疗AI质变时刻来临!国产医疗AI率先突破,临床诊疗能力问鼎全球
文章指出当前医疗AI真实能力与临床期待有落差,为此中国医生联合制定全球首个评估医疗AI临床适用性标准,完成对主流模型测评,中国企业打造的MedGPT夺冠,还推出‘未来医生’平台服务患者。
中国人能飞!杭州发布全球首款站姿载人飞行器
杭州酷飞发布站姿个人飞行器Urban、坐姿个人飞行器Dream及自研NA80飞控系统。产品操作简便,已获海外近百台定金订单,还构建了安全防护体系并补齐保险。两款飞行器定位不同,核心是自研飞控。