Qwen2.5-0.5B」共找到 3948 篇相关文章

新闻资讯7

2025 IMO真题撕碎AI数学神话,全球顶尖模型齐翻车!冠军铜牌都拿不到

2025 IMO数学竞赛中,全球顶尖AI模型均翻车。冠军Gemini 2.5 Pro仅得31分,连铜牌都拿不到。Grok - 4表现糟糕,DeepSeek - R1也令人失望。AI虽有思路,但逻辑细节不足,离成奥数大师尚远。

新智元
产品应用7

Cursor自研新模型反超Opus 4.6,价格还“打一折”!网友实测:只有它写完应用能一次跑通

Cursor发布第二代编程大模型Composer 2.0,在关键编程基准测试上反超Claude旗舰模型Opus 4.6,价格还“打一折”。网友实测其写完应用能一次跑通,效率和成本优势明显。但Cursor面临代码编辑器地位下降的危机,正积极自救。

AI前线
新闻资讯7

人形机器人开始打国球了!两台机器人完整打完11分制比赛

第二届世界人形机器人运动会8月22 - 26日将在「冰丝带」举行,港大超维战队的两台人形机器人按11分制自主打完一局。其采用自主研发的SMASH 2.0系统,团队还探讨技术难点、系统升级等问题。

量子位
产品应用7

谷歌IMO金牌模型可以用了!推理性能秒了o3、Grok 4

谷歌拿下IMO金牌的模型Gemini 2.5 Deep Think已在Gemini App推出,速度更快、实用性更强。该模型仅对Ultra订阅用户开放,月费约1803元。其推理性能超o3、Grok 4,有迭代开发等优势。

量子位
新闻资讯7

刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想

本周五,谷歌向 Google AI Ultra 订阅用户推出 Deep Think 功能,提供全版本 Gemini 2.5 Deep Think 模型给部分数学家。该模型是获 IMO 金牌模型变体,速度更快,有并行思维等技术,在多领域有用且测试成绩优。

机器之心
开源动态7

马斯克点赞的APP来了!刚下场视频世界模型,就拿下评测第一

实时视频世界模型成热门,Loopit发布的实时互动世界模型Zing - 0.5在评测中获第一且已开源。该公司提出独特观点,认为实时视频非世界,互动应“模应一体”,还指出抵达端到端终局的新路径。

新智元
开源动态8

英伟达MIT出手!华人团队重磅开源,大模型推理内存暴降10倍

英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗降10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。

新智元
产品应用8

真正的一句话修图:Gemini 用香蕉模型给出了图像生成的分水岭

Google新模型Gemini 2.5 Flash Image可在AI Studio体验。它有多图融合、角色一致性等能力,能实现自然语言编辑图像,速度快、价格低、API可用,虽有中文体验等问题,但有望让AI视觉工具进入工程化时代。

MacTalk
产品应用7

高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
产品应用8

5000万用户、5000万美金ARR,全球第一AI创作消费平台要做AI时代Roblox

在AI大模型军备竞赛中,用户侧出现‘智能过剩’。SeaArt成立两年半成全球访问量第一的AI内容创作社区,其2.0版本SeaVerse实现全流程自动化。该公司不陷‘卖模型’陷阱,商业模式独特,有望成AI时代全民级内容平台。

机器之心