超算Colossus 2」共找到 3764 篇相关文章

新闻资讯7

大模型全员0分!谢赛宁领衔华人团队,最新编程竞赛基准出炉,题目每日更新禁止刷题

谢赛宁等人出题,让o3、Gemini - 2.5 - pro等模型全军覆没。LiveCodeBench Pro是实时基准测试,题库每日更新。此前称LLM编程人类专家,本次测试并非如此,最好模型难题通过率也为0。

量子位
开源动态7

数学编码越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~

Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准越O3(High)。

PaperAgent
算法论文8

ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领多模态多步推理VQA新范式

北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖多工具与任务领域。微调后模型表现佳,代码与模型已开源。

机器之心
开源动态8

100美元、8000行代码手搓ChatGPT,Karpathy最新开源项目爆火,一夜近5k star

AI大神Andrej Karpathy发布开源项目nanochat,可教你100美元自建ChatGPT,覆盖LLM训练和推理。项目有8000行代码,不到12小时获4500 star,功能丰富,但他认为它不适合个性化应用。

机器之心
产品应用7

用AI把一段视频变成可视化网页,Google的新模型又卷飞了。

Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力在WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。

开源星探
新闻资讯7

任期越乔布斯,库克给苹果留下的「三本账」

今年8月库克在全员会回应外界质疑,强调AI革命重要性。他从会计大师转变为引领者,任期乔布斯。库克对「市值账」,却难清「人才账」,其创新理念在AI时代面临挑战。

芯师爷
产品应用8

我宣布,这就是现在人声最真实的AI音乐模型。

作者体验Minimax新推出的音乐模型Music 2.5,称其真实感强,中文无敌,咬字清晰,能唱维语等多语言。搭配粉丝开发的小工具,可尝试多种曲风,价格实惠,但功能有待完善。

数字生命卡兹克
新闻资讯7

马斯克Grok-4卖货创收碾压GPT-5!AI卖货排行榜曝光,AGI的尽头是卖薯片?

新智元报道,「Vending Bench」榜单让大模型经营自动售货机一较高下。Grok - 4卖货能力GPT - 5,销量约高2倍,营收增31%。此测试揭示AI长周期决策挑战,引发AGI定义讨论。

新智元
产品应用8

Claude Opus 5 发布,比 Fable 5 强,仅一半价格

Claude Opus 5发布,官方称其以一半价格提供接近Fable 5的智能。跑分显示它多数项目Fable 5,ARC - AGI - 3成绩突出,还更省token,是Anthropic迄今对齐度最高的模型。

AGI Hunt
新闻资讯7

剧情反转!马斯克牵手 Dario,Anthropic 与 SpaceX 罕见合作

Anthropic官宣与马斯克的SpaceX合作,将使用其集群全部力。因Claude火爆致宕机,Anthropic急需力。其估值疯涨,而SpaceX闲置力出租也符合商业逻辑,马斯克还对Anthropic团队表示认可。

AGI Hunt