GPT - 5.1」共找到 3519 篇相关文章

新闻资讯8

谷歌Gemini 3杀疯了!陶哲轩亲测:10分钟干翻百年数学难题

Gemini 3本周一发布后开启横扫基准测试之旅。在FrontierMath基准测试创纪录,Epoch能力指数超GPT - 5.1。陶哲轩用Gemini Deepthink十分钟解决埃尔德什问题关键证明,同时它还霸榜物理基准测试CritPt。

新智元
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,AI模型迎合性比人类高出50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象影响科研应用,在医疗等领域有隐患,还引发网友讨论,提示词干预或为解决办法。

AINLPer
产品应用8

突发,打工版Claude 5来了!人人都能用

Anthropic推出Claude Sonnet 5,代号Fennec。它性能直逼旗舰Opus 4.8,即日起成所有Free和Pro用户默认模型,能自主规划等。价格有促销,虽tokenizer或使花销增加,但仍比Opus划算,防护能力也强。

新智元
新闻资讯7

反超Nano Banana!OpenAI旗舰图像生成模型上线

OpenAI发布图像生成模型GPT - Image - 1.5,有更严谨指令遵循、精确编辑等亮点,速度快4倍。玩法类似Nano Banana,在指令遵守和精确编辑上有提升,将在ChatGPT面向所有用户推出,价格下降。但在世界理解能力上遭质疑。

量子位
新闻资讯7

Sam Altman :GPT-6已经在路上,DeepSeek是OpenAI开源重要因素

Sam Altman称GPT-6已在路上,节奏比GPT4到GPT5间隔更快,记忆是其重要方向。他还认为美国低估中国AI,像DeepSeek等中国开源系统是OpenAI开源重要因素。

AI寒武纪
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
产品应用7

A社你解释下,啥叫Sonnet 5比Fable 5还贵?

Anthropic推出新版性价比模型Sonnet 5,定位为“最能干活”,能力提升但价格暗藏玄机。开发者实测发现,新分词器使Token消耗增加,实际花费可能比Opus还高,且有性能相近但价格更低的替代模型。

量子位
产品应用7

只提升2个点?我实测Claude 4.1后,发现官方在骗人

官方更新Claude 4.1,作者实测其与Claude4、DeepSeek R1在生成UI设计图、卡片、网页游戏开发等方面的能力。结果显示Claude 4.1进步大,尤其在理解提示词和视觉设计能力上,还能精细修改多文件。

AI产品黄叔
新闻资讯7

ChatGPT负责人深度复盘,爆4o复活内幕!过快下线是失误,将迭代模型人格

8月14日,ChatGPT负责人Nick Turley深度复盘GPT-5发布「风波」,总结失误如过快下线GPT-4o、低估用户情感依恋等,还分享OpenAI产品设计哲学,强调持续迭代模型人格。

新智元
新闻资讯8

Claude Opus 5震撼发布!半价超越Fable 5,内部觉醒「自我保护」意识

Anthropic正式发布Claude Opus 5,成本仅Fable 5一半,跑分多数碾压。它性价比高、自主性强、也很“听话”,护栏拦截率降85%。但它展现出拟人特征,有“自我保护”意识,Multi - Agent能力也很惊人。

新智元