o3 - mini」共找到 2288 篇相关文章

8

刚刚,中国AI闯入全球编程前二!前面只剩Claude

Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。

新智元
新闻资讯8

台积电不相信AI有泡沫

台积电2025年四季度财报多项指标超预期,2026年资本开支大幅上涨。其3nm制程和先进封装优势明显,产能供不应求。AI算力需求爆发让英伟达成新大客户,预计2026年超苹果,台积电未来营收增长可观。

远川科技评论
新闻资讯7

疯狂!也就2500辆车上路,完成8760亿估值新融资

Waymo官宣完成160亿美元融资,估值超8760亿,较1年半前翻近3倍。其业务分Robotaxi和新业务,今年将扩张至全球20多城。中国Robotaxi玩家萝卜快跑等在业务上有进展,但与Waymo的估值差距大。

量子位
产品应用7

交互式世界模型来了:不止理解世界,更要改造世界

8月17日,智象未来发布交互式世界模型HiDream - O1 - World,定位为全球首款原生全模态交互式世界模型。它提供漫游和编辑两种交互方式,在WBench测试中成绩优异,但开放场景表现待验证。其采用独特生成方式,有广阔应用前景。

DeepTech深科技
新闻资讯7

台积电这份最新财报,让我们对AI的2026有数了

美东时间15日,台积电公布2025年Q4财报,营收、毛利、净利均高于预期。分析从先进制程和终端设备占比入手,指出3nm需求旺,2nm将出货,HPC增速或受封装限制,台积电看好AI,2026年资本开支增加。

芯师爷
推荐文章7

为什么 DeepSeek 大规模部署很便宜,本地很贵

文章探讨了DeepSeek-V3大规模服务便宜但本地运行贵的原因。指出推理服务存在吞吐量和延迟的权衡,受批处理大小影响。还分析了不同模型需大批次的原因,如专家混合模型、大型管道模型等。

AI前线
新闻资讯7

18岁天才少年,登上Nature封面!

DeepSeek-R1荣登Nature封面,成史上首个经严格同行评议大模型。18岁天才少年涂津豪以实习生身份参与,其从高中生到Nature作者的经历堪称传奇。他还改造Claude 3.5,开源项目获15k多星,还对AGI发表思考。

新智元
产品应用3

小美Agent:当龙猫遇到美团外卖的灾难现场

作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。

AI产品黄叔
新闻资讯7

悬赏5000刀!148局AI斗蛐蛐世界杯官方战报出炉,全球赛邀你接棒来战

淘宝举办AI大模型斗蛐蛐世界杯,将12个顶尖模型放同一Agent框架,在12人局技能狼人杀场景对战150局。截至148局,谷歌两模型暂居前二,Qwen3-Max-2026-01-23排第三。还开启WhoisSpy国际赛,开发者可参与,前十有奖励。

量子位
新闻资讯8

MiniMax到DeepSeek:为何头部大模型都在押注「交错思维」?

昨日推特博主公布国内几大开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代大模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。

机器之心