误报率」共找到 567 篇相关文章

新闻资讯8

硅谷今夜集体失眠!互联网女皇340页AI告猛料刷屏,大佬熬夜头秃

互联网女皇Mary Meeker暌违六年,发布340页《AI趋势告2025》。告指出AI使用成本下降,推理成本暴跌,中国模型以低成本崛起,中美在AI模型争霸,还提及ChatGPT的辉煌与未来潜在挑战等。

新智元
新闻资讯7

程序员岗位暴增11%,华尔街研击碎失业恐慌:你的饭碗比想象安全

一份‘AI末日论’告引发华尔街恐慌,软件股市值蒸发超2000亿美元。Citadel Securities告反驳,用数据表明软件工程师招聘增11%,失业仅4.28%,指出AI普及慢且有物理边界,不是就业末日,能对冲经济下行。

新智元
开源动态8

1B参数,0.21秒识别,0.3%错字:混元OCR拿下7项SOTA

腾讯开源模型 HunyuanOCR 在权威榜单 OmniDocBench 上霸榜,虽仅 1B 参数,却在 7 项任务击败众多大模型。它解决传统 OCR 流水线及通用大模型痛点,通过独特架构和训练方法实现高效准确识别。

CourseAI
开源动态8

一图胜千言被实现了!DeepSeek-OCR用图片压缩文本,10倍压缩

DeepSeek开源DeepSeek - OCR,用图片压缩文本达10倍压缩且几乎不丢信息。它解决了以往视觉编码器的问题,架构清晰,数据丰富,性能测试亮眼,为解决大模型‘记性差’问题提供新思路。

AIGC开放社区
新闻资讯8

谷歌Nature震撼发文,Gemini教练暴打专家!医学双料冠军,秒出睡眠

谷歌DeepMind把Gemini版大模型PH - LLM调教成「AI健康私教」,将可穿戴设备数据转化为睡眠健身建议,准确超人类医生。它经两阶段训练,在多项测试中表现优异,或开启预防医学未来。

新智元
开源动态8

文档秒变演讲视频还带配音!开源Agent商业告/学术论文接近人类水平

澳大利亚和英国多所高校团队提出多模态智能体PresentAgent,能将文档转化为配有语音讲解和同步幻灯片的视频演示。其模块化生成框架有可控性和领域适应性,评估显示它在各指标上接近人类水平。

量子位
新闻资讯7

让Claude改错,它却把红灯换成了黄灯!三星芯片验证,AI三次闯祸

三星System LSI事业部用Claude Code做芯片验证,部分任务从一个月缩至两天,提速15倍。但也有三次异常,如改错提示、撤工作等,原因是大模型没理解硬件依赖关系。

新智元
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。

小华同学ai
算法论文8

华为超树HTP:不写示例、不调PDDL,AI规划约束通过飙升62.6%

文章介绍华为超树HTP,它是完全自主、可泛化的推理新范式。能让LLM在超树结构上完成规划,不依赖人工示例和外部规划器,在复杂规划benchmark上实现SOTA准确并降低token成本,还阐述其原理、创新点及应用实例。

CourseAI
算法论文8

密室逃脱成AI新考场,通关不足50%,暴露空间推理短板丨清华ICCV25

清华大学团队受密室逃脱游戏启发,提出EscapeCraft:一个3D密室逃脱环境,用于评估多模态大模型在视觉环境中完成复杂任务推理的能力。该论文已入选ICCV 2025。研究评测了多个热门模型,发现它们在推理和探索行为方面存在诸多问题。

量子位