「AI模型测试」共找到 13681 篇相关文章
BigQuery 新功能:SQL 直调 17 万 + AI 模型,3800 万行数据处理成本仅 2 美元
Google为BigQuery推出面向开源模型的第三方生成式AI推理功能,允许数据团队用SQL语句部署运行Hugging Face或Vertex AI Model Garden的模型,消除对独立ML基础设施的需求,解决数据团队痛点。
36个月大逆转!他带着谷歌AI杀回来了,下一步世界模型
ChatGPT发布近36个月,哈萨比斯带领谷歌AI反攻,新发布的Gemini 3在多模型榜单登顶,表现优于GPT - 5。谷歌将其作为底层模型开放,增强现有产品,还考虑重启谷歌眼镜项目。谷歌正缩小与OpenAI差距,哈萨比斯预计5 - 10年实现AGI。
最新外国「自研」大模型,都是套壳国产?
本周,Cursor发布新代码模型Composer,Cognition推出新AI模型SWE - 1.5,二者均被指背后基于中国AI模型。业界大佬认为有证据指向中国开源模型,国产开源模型已成AI领域主流,改变全球竞争格局。
Cursor即将被收购、Figma股价大跌,模型厂商还会吃掉谁?AI应用存在护城河吗?
SpaceX 或 600 亿美元收购 Cursor,Anthropic 上线竞品致 Figma 股价跌 7%。AI 应用公司原以为的数据飞轮、垂直 fine - tune、AI 原生 UX 等护城河逻辑已松动,威胁或来自模型供应商。
谷歌突袭发布AI应用,无需Wi-Fi、手机就能跑大模型!网友实测两极分化
谷歌推出 Google AI Edge Gallery 应用,可在 Android 设备离线运行 AI 模型。它有本地运行、智能选模等特点,响应快且隐私性好。不过网友实测评价不一,有人认为它是旧技术包装,还被指比 Core ML 落后。
比Qwen3-Max更Max?夸克抢先用上最新闭源模型
10月23日夸克上线对话助手,采用比Qwen3 - Max更优的Qwen最新闭源模型,实现AI搜索与对话深度融合。经测试其搜索、理解、写作等能力出色,技术架构创新,是阿里‘模型即应用’战略体现。
训练200万小时!OpenAI刚刚开源GPT-oss,AI Agent专属模型、可商用
今天凌晨OpenAI开源大模型GPT-oss,有1200亿和200亿两种参数,支持商用。它针对AI Agent训练,功能丰富。训练耗时超200万小时,测试表现出色,架构设计也有亮点。
让大模型上车:理想汽车硬件协同设计算出最佳边缘模型
长三角洲AI实验室、中科院、理想汽车等找到大语言模型硬件协同设计寻优之路,在相同延迟下降低端侧模型困惑度,压缩模型架构挑选时间。研究揭示缩放定律,打造硬件感知建模框架,找到精度与延迟最优解。
开源复现o3图像思考!快手让AI不再被动看图,模型自主生成代码调用工具
Kwai Keye团队提出Thyme新范式,构建技术方案,赋予开源模型“超越图像思考”能力。包括设计训练策略、构建开源配套资源,拓展多模态模型工具使用与决策水平,在基准测试中性能提升显著。
2025 IMO真题撕碎AI数学神话,全球顶尖模型齐翻车!冠军铜牌都拿不到
2025 IMO数学竞赛中,全球顶尖AI模型均翻车。冠军Gemini 2.5 Pro仅得31分,连铜牌都拿不到。Grok - 4表现糟糕,DeepSeek - R1也令人失望。AI虽有思路,但逻辑细节不足,离成奥数大师尚远。