测试时间扩展」共找到 2432 篇相关文章

算法论文8

登顶多模态推理榜MMMU!UCSD新方法超越GPT-5、Gemini

加州大学圣地亚哥分校团队开发的DreamPRM-1.5在MMMU测评榜夺冠,超越GPT-5、Gemini 2.5 Pro Deep-Think。它细化加权粒度到样本,有Instance Table和Instance Net架构,采用双层优化与生成式奖励模型。

新智元
产品应用8

大模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用和开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent
算法论文8

邱锡鹏老师团队发布VehicleWorld:让智能汽车真“智能”

邱锡鹏老师团队发布论文,构建高度仿真的智能座舱虚拟环境VehicleWorld,并提出基于状态的函数调用(SFC)方法。实验显示,SFC大幅提升任务执行准确率和效率,还构建了Vehicle Benchmark进行评估。

深度学习自然语言处理
推荐文章7

下一代数据中心和高性能计算OIO光互连技术方案!

文章深度解析OIO芯片级光互连技术、挑战与未来。传统电I/O技术有性能受限等问题,OIO能解决大容量芯片I/O扇出难题,是光电融合终极形态。它虽面临量产挑战,但前景好,全球产业力量已集结。

芯师爷
产品应用7

一帮人All in AI,让搞体育的先赚到钱了

港股运动科技第一股Keep今年2月决定“All in AI”,近日发布财报宣布扭亏为盈,实现经调整净利润1035万元。这不仅是降本增效的结果,也意味着Keep在资本市场的身份发生了变化,成为全民AI应用的候选者。

量子位
产品应用8

谷歌2.5 Image:『你是我的神』,准备丢掉PS了

谷歌新出的大模型Gemini 2.5 Flash Image实现AI图像创作一致性、真实性新高度。它能理解手绘图表、解答问题及完成复杂编辑指令,可在Gemini和Google AI Studio免费使用,表现出色,有望取代很多PS任务。

鲸选AI
推荐文章7

Python 2还能走多远?

自2020年Python 2停止维护,虽仍有项目在用,但企业和社区都在向Python 3迈进。文章介绍了Python 2的发展历程、存在的问题,阐述Python 3的优势,并给出了从Python 2切换到Python 3的方法。

腾讯技术工程
新闻资讯8

DeepSeek 官宣V3.1:迈向 Agent 时代的第一步!

DeepSeek 官宣发布 V3.1,称这是迈向 Agent 时代第一步。其有混合推理模式,Agent 能力全面进化,API 也全面升级,支持 Anthropic API 格式。还继续开源,9 月 5 日起调整价格,社区反响热烈。

AGI Hunt
新闻资讯7

只因太信ChatGPT,60岁男子三个月后险进精神病院...

美国《内科医学年鉴》刊登真实病例,60岁男子听ChatGPT建议用溴化钠代替食盐养生,致溴中毒,身心失控。医生实验发现ChatGPT回复缺健康警告,今年已有12起因信ChatGPT住院案例。

AI科技大本营
新闻资讯7

当未经检查的自动扩缩造成 12 万美元的云支出时

Reddit 上一个云成本恐怖故事引发热议,一集群遭 DDoS 攻击自动扩展,72 小时产生 12 万美元账单。Zero Cloud Waste 创始人给出预防措施,各方也发表看法,凸显需 FinOps 战略配合自动扩缩。

InfoQ