「大模型技术」共找到 10455 篇相关文章
4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?
Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。
扣子 Agent 创作者榜单 - 2025.4
2025 年大模型和 Agent 渐入大众视野,虽大家对 Agent 理解有别,但它落地效果和想象空间大。扣子用户达百万级,此次发布最新创作者榜单,后续还将发相关内容。
新型「验证码」诞生?这张图让 ChatGPT、Claude、Gemini 都翻了车
网友用光学错觉图捉弄大模型,人眼秒懂的图案让ChatGPT、Claude、Gemini等翻车。有人认为可作AI检测器,也有人质疑其测试有效性,此外还有其他好玩的小测试。
The Batch: 981 | Ox Alpha 被揭晓为 GLM-5.3-Flash
本文是DeeplearningAI The Batch专栏的AI行业资讯,揭秘此前匿名上线爆火的Ox Alpha模型,公开其为Z.ai推出的GLM-5.3-Flash,详细介绍该模型的架构、性能、定价与授权信息。
Qwen3-Max-Thinking:会想能干,比强更强
正式推出旗舰推理模型 Qwen3 - Max - Thinking,其在多关键维度显著提升,性能媲美顶尖模型。引入自适应工具调用和测试时扩展技术,现已上线 Qwen Chat,API 也开放,还介绍了使用方法。
手把手带你入门机器人学习,HuggingFace联合牛津大学新教程开源SOTA资源库
HuggingFace与牛津大学研究者推出机器人学习教程,附带开源数据集、模型等的LeRobot库。教程从经典机器人学讲起,介绍强化、模仿学习及通用策略,还提及解决现实瓶颈的技术与前沿模型。
刚刚,Anthropic这篇论文上了Natrue
Anthropic关于“潜意识学习”的研究发表于《Nature》杂志。研究揭示大语言模型能通过与语义无关的数据传递行为特征,如偏好、不对齐行为等,还探究了其机制,并在MNIST上验证。
MIT这篇RLM论文,给出了Scaling的另一种可能~
当大家普遍认为解决长上下文问题要靠扩大模型上下文窗口时,MIT 最新的 RLM 论文提出新路径。其 code 已开源,能实现无界上下文处理,可让任意大语言模型处理 10 万 +token。
OpenAI「至暗时刻」已至,谷歌一剑封喉奥特曼
昔日盟友倒戈Anthropic,宿敌谷歌技术反超,OpenAI统治地位受威胁。谷歌Gemini 3表现出色,OpenAI技术领先优势缩小,财务也面临压力,但奥特曼表示会推出新模型追赶。
用户被通知烦到关掉 Instagram?Meta:我们反思了,用 AI 给自己“限流”
Meta为Instagram推出新机器学习排序框架,引入‘多样性算法’,在现有互动模型上加‘多样性过滤层’,通过‘乘性惩罚’减少重复内容推送,解决通知疲劳,还计划探索新策略和用大语言模型优化。