看表测试」共找到 2198 篇相关文章

产品应用8

真·全民AI健康管家来了!实测蚂蚁AQ:追问识药皮肤,还能连医院接硬件

蚂蚁上线AI健康管家APP——AQ,有超百项AI功能,连接超5000家医院、近百万医生等。它能追问识药皮肤,打通硬件,设语音通话。凭借技术和生态优势,实现从技术工具到健康管家的跃迁。

量子位
产品应用8

Sora2不够香了!这款国产AI视频模型已经能边边生成,生成快还互动佳

国内AI视频玩家弯道超车,百度蒸汽机(文心专精版)开卷实时流式生成。它能边边生成,生成快还互动佳,实现生成迅速、实时交互、无限续写,重新定义AI视频生成领域。

量子位
开源动态8

让模型“视频写网页”,GPT-5仅得36.35分!上海AI Lab联合发布首个video2code基准

上海人工智能实验室等机构提出IWR - Bench评测基准,从“image - to - code”迈向“video - to - code”,对28个主流模型测试,最佳模型GPT - 5仅36.35分,指出当前模型短板,为研究指明方向。

量子位
产品应用7

豆包大模型2.0+Claude Skills,3步装好,终于有AI能帮我"视频做笔记"了!火山引擎全系列可用!

传统视频总结工具只基于音频总结,内容浅显。而豆包大模型2.0是多模态原生模型,能同时处理画面和声音。只需3步安装配置,就能让它真正“”视频,输出详细笔记。

AI产品自由
产品应用7

grok 4一图流

文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。

AI寒武纪
新闻资讯7

LLM总是把简单任务复杂化,Karpathy无语:有些任务无需那么多思考

随着推理大模型和思维链普及,大模型有了‘深度思考’能力,但现在有些偏科,简单任务也复杂化。AI大牛Andrej Karpathy发长文指出该现象,认为是基准测试优化所致,大模型发展不能只追求分数。

机器之心
新闻资讯8

马斯克将用最强Grok 5,挑战LOL最强战队T1!

马斯克让Grok 5戴「纯视觉感知」与「拟人延迟」镣铐挑战LOL传奇战队T1。这是终极图灵测试,AI像人一样感知与推理。对决为特斯拉Optimus练兵,若AI懂团战,就能理解现实世界。

新智元
新闻资讯7

奥特曼仓促亮剑GPT-5.2!一张图爆火全网,全面碾压Gemini 3

谷歌发布Gemini 3,其惊艳现打乱OpenAI阵脚,公司进入「红色警戒」,将提前于12月9号发布GPT - 5.2应对。网传GPT - 5.2测试分数全面超Gemini 3 Pro,但遭网友质疑。OpenAI面临用户流失等危机。

新智元
新闻资讯6

GPT-5:没有AGI,失望和天花板,最具竞争力的可能是定价

完GPT - 5发布会,整体令人失望。发布会现错误图片,市场反馈不佳,专家认为开发仓促。它有三个型号,基础性能现不一,在部分测试中不如竞品,亮点是价格有竞争力,代码能力受开发者好评。

AI寒武纪
推荐文章7

AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?

《代码整洁之道》作者罗伯特·C·马丁不逐行 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。

特工宇宙