误报率」共找到 567 篇相关文章

新闻资讯8

MIT告:花了300-400亿美元,95%的企业AI项目都失败了

MIT《2025年商业AI现状》告显示,企业投300 - 400亿美元在GenAI,95%项目零回。揭示企业AI工具糟糕的原因,指出影子AI经济现象,点明钱花错地方,还阐述成功企业做法及未来趋势。

AI工程化
开源动态8

看完Kimi K2.5技术告,它的视觉Agentic真给我惊到了

Moonshot AI发布Kimi K2.5技术告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。

PaperAgent
产品应用8

国产Deep Research杀出一匹「裸奔」黑马:免费开放,过程透明,网页告一键即出

国产AI搜索秘塔AI搜索放大招,深度研究功能发布即免费公开,自带新玩法,思考过程透明。在评测集上表现优,可应对复杂问题,生成规范告,还能转互动网页,严谨度与易用性兼备。

量子位
新闻资讯7

大模型公司挖墙脚哪家强?告:Anthropic人才吸引力是OpenAI的8倍,留存达80%

风险投资公司SignalFire告显示,大模型公司人才争夺激烈,Anthropic是大赢家,顶尖AI人才留存达80%,从OpenAI等公司挖人成效显著,秘诀在于精准挖角、独特文化和产品共鸣。

量子位
开源动态8

智谱终于发布GLM-4.5技术告,从预训练到后训练,细节大公开

上个月底智谱开源 GLM-4.5 及轻量版,成绩亮眼引热议。现其技术告发布,详述预训练到后训练细节,还介绍了开源 RL 框架 slime,展示模型架构、训练阶段等,评估了在多任务上的表现。

机器之心
新闻资讯7

深度揭秘OpenAI如何让GPT-5「技术性」超越Claude:悄悄跳过最难的23道题

OpenAI发布会上称GPT-5代码能力全球第一,其在SWE-bench Verified基准获74.9%通过,略高于Claude Opus 4.1的74.5%。但OpenAI未做23道难题,若计入,GPT-5实际通过或低于Claude。

新智元
推荐文章7

当 AI 能写代码修 bug,高考计算机专业是“火坑”还是“新机遇” |深度对话 6 位专家

在 AI 浪潮下,编程范式变革,开发岗位结构改变。本文采访 6 位专家探讨高考生计算机专业是否值得,还分析适合人群、专业核心技能重要性变化等,为考生提供多维度参考。

AI科技大本营
新闻资讯7

Google 发布 142 页年度DORA 告:90% 开发者每天花 2 小时使用AI,比去年增长14%

Google发布142页年度DORA告,显示90%开发者每天花2小时用AI,比去年增14%。开发者对AI代码信任谨慎,看法分化,速度提升比质量改善明显。告还分析团队类型、采用时间等,指出技术限制和就业现状。

AGI Hunt
产品应用7

真·博士水平!GPT-5首次给出第四矩定理显式收敛,数学教授只点拨了一下

在数学教授引导下,GPT - 5首次将定性的第四矩定理扩展为带有显式收敛的定量形式,明确了收敛速。研究人员还引导其将结果推广到泊松情形,作者起初想将其列为论文共同作者但被 arXiv 政策禁止。

量子位
算法论文8

AI修Bug新SOTA:SWE-Bench Lite60.33%修复,像人一样能积累经验,中科院软件所出品

ExpeRepair是中科院软件所团队推出的仓库级缺陷修复系统,模拟人类认知的情景和语义两种记忆模式,能积累经验。在SWE - Bench Lite评测中,其Claude - 4+o4 - mini组合修复达60.3%居首。

量子位