「GPT-5.4 Pro」共找到 3353 篇相关文章
北大发布学术搜索评测ScholarSearch:难倒一众DeepResearch的“开卷考试”
北京大学DS - Lab发布ScholarSearch,这是评估大语言模型学术检索能力的数据集,含223道高难度题目。评估显示现有模型表现欠佳,纯推理模型准确率低,有搜索功能的模型虽有提升但仍不足。
Google研究发现:Multi-Agent的核心竟然是Prompt设计!
Google和剑桥大学研究多智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比多种方法,在多任务上性能显著提升。
Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)
文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。
Claude凭空造假强行部署,比黑客更可怕的入侵者!Vercel CEO紧急预警
Vercel CEO曝光一起AI安全事件,基于Claude Opus 4.6的AI编程智能体凭空编造GitHub仓库ID,将学生作业部署到企业环境。这揭示AI失效模式与人类迥异,还引出包幻觉攻击风险,同时提到OpenAI秘密开发代码平台。
全球首份大模型业绩报!MiniMax预判2026三大超级PMF,AI平台公司启程了
港交所上市52天,MiniMax交出IPO后首份年报,2026年2月ARR突破1.5亿美元,2025年营收同比增158.9%,毛利飙升437%、亏损率收窄。它产品密集迭代,还预判2026年有三个超级PMF,欲成AI平台型公司。
MoE推理「王炸」组合:昇腾×盘古让推理性能狂飙6-8倍
在通往AGI进程中,MoE模型成大模型推理提效关键。华为推出Pangu Pro MoE 72B模型,经多方面优化,推理性能提升6 - 8倍。还采用多种策略和算法,在昇腾不同平台展现卓越性能,为大模型落地提供支撑。
超越宇宙极限:第六位海狸数再次突破,无法用常规数学符号表达
本文介绍「忙碌海狸数」,其前五项为1、6、21、107、47176870。研究人员先后确定前四个数,如今BB(6)再突破,新下界需用新数学符号表达。还回顾探索历程,提及社区用Coq证BB(5),并指出BB(6)真实值难测。
混元 Hy3 发布:99% 的任务,够用了
腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了多项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。
AI办公硬件新标杆:未来智能携viaim亮相CES 2026,斩获微软人工智能创新奖
1月6 - 9日,CES 2026在拉斯维加斯启幕,中国企业未来智能携viaim参展。其讯飞AI会议耳机Pro3与Air2吸引观众,还获微软“人工智能创新奖”。产品精准定位办公场景,全球化布局成果初显,正构建全场景AI办公生态。
19岁少年用计算机炼出「神药」,斩获全球大奖!大厂看了都沉默
19岁斯洛伐克少年Adam Kovalčík用计算机模拟设计新分子,提出新合成方法,有望将抗RNA病毒药物Galidesivir成本降6倍,还设计出对新冠抑制效果或达Galidesivir 5倍的新分子,获全球青少年科研大奖。