GPT - 3」共找到 2790 篇相关文章

推荐文章7

当前关于 Vibe Engineering 的所有认知都会在 1 个月内严重过时

作者分享 Vibe Engineering 实践体会,指出当前认知很快过时,因 AI 编程工具和模型进步大。还对比了 Opus 4.5、GPT - 5.2 等模型,阐述人在开发各阶段角色,介绍多 Agent 协同实践及未来软件公司组织形态变化。

InfoQ
新闻资讯7

30 年 FAANG 大神被 C++ Bug “虐”4年,竟被Claude Opus 4一招解决!

上周 Anthropic 发布 Claude Opus 4,称其为“全球最强编程模型”。本周,有 30 多年 C++ 开发经验的 ShelZuuz 用它解决了困扰 4 年的“白鲸 Bug”,此前用 GPT - 4.1 等模型均无果。不过他认为它像“初级开发者”。

AI科技大本营
产品应用7

The Batch: 916 | Gemini 强势领跑

谷歌更新旗舰 Gemini 模型,推出 Gemini 3.1 Pro Preview,以相同价格实现性能跃升。它在多项基准测试中领先,性价比超对手,虽部分测试落后竞品,但提升或源于模型质量改进,成本效益策略值得关注。

DeeplearningAI
新闻资讯8

谷歌2025「复仇爽文」大结局!从至暗时刻到王者归来

2025年谷歌上演AI复仇大戏,年初被唱衰,年底凭Gemini 3等组合拳重回巅峰。在模型、开发、创意等8大领域突围,还兼顾安全责任。全年各月不断推新,涵盖系统、工具、模型等多方面。

新智元
产品应用7

夸克 AI 对话助手的邪修打开方式:一句话直通网盘,看电影、找资料全拿下

阿里“C计划”首个成果,夸克App深度整合对话助手,用Qwen3 - Max模型。可随意切换模式,其独特之处是提问资料或电影,能直返夸克网盘链接,“搜、用、存”一气呵成,与其他AI助手不同。

AI进修生
新闻资讯7

2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流大模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。

新智元
新闻资讯7

Sam Altman宣告软件开发即将进入"快时尚时代"!机遇还是危机

Sam Altman宣告SaaS将进入快时尚时代,新的GPT - 5编程能力或让开发SaaS像Zara出新款般轻松。但此概念最早由Patricio提出,他认为AI编程会带来‘代码污染’,与Sam态度不同。

AI工程化
产品应用7

我让10个大模型又参加了完整版数学高考,第一名居然是它。。。

作者让10个大模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题大模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。

数字生命卡兹克
新闻资讯7

AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。

作者和同事测试AI色盲测试图,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看图断章取义,缺乏人类的“格式塔”能力。

数字生命卡兹克
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区