大模型技术」共找到 10361 篇相关文章

新闻资讯8

DeepSeek、智谱被曝造芯,国产模型绕开英伟达!

据路透社等爆料,DeepSeek与智谱AI正秘密自研定制化AI芯片,目标是摆脱对英伟达等的硬件依赖,构建自身算力生态。因算力账本和外部环境压力,两家公司选择研发面向推理场景的芯片。

新智元
新闻资讯7

Skills vs MCP,谁才是「模型的 HTTP 时刻」?

近期,Anthropic新推Claude Skills获好评,而MCP协议一周年却很寂静。文章探讨MCP定位、适用边界及潜在价值,分析其与Claude Skills的关系,指出MCP生态现状及适用业务场景。

机器之心
产品应用7

模型系统提示词逆向(2)—— Cursor

作者研究模型提示词注入时,用简单提示词“骗”出 Cursor 系统提示词。文中分析提示词生效原理、对 Cursor 有效的原因,还提及提示词泄露的安全问题及开发者应对建议。

AI Reading Hub
算法论文7

多智能体语言模型中的人类自适应协作

尽管语言模型有进展,但纯自治多智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 在基准测试中表现出色,为构建 Agentic 系统提供指导。

深度学习自然语言处理
产品应用7

模型系统提示词逆向(1)—— ChatGPT

文章介绍模型系统提示词逆向原理,利用‘认知冲突’让AI意外‘泄密’。还给出逆向提示词示例,并展示了ChatGPT系统提示词原文及翻译,包含其角色设定、工具使用规则等内容。

AI Reading Hub
开源动态8

开源Qwen一周连刷三冠,暴击闭源模型!基础模型推理编程均SOTA

通义千问卷疯了,Qwen3-Coder刚登场,全新开源Qwen3系列最强推理模型Qwen3-235B-A22B-Thinking-2507又刷新SOTA。一周内,通义千问完成开源三连,在基础模型、编程模型、推理模型方面均达全球开源最强。

量子位
算法论文8

“最强具身VLA模型”,究竟强在哪儿?

机器人基础模型π*0.6刷屏,能让机器人高效完成多项任务。它引入Recap学习法,突破传统模仿模式。其核心方法RECAP让VLA用奖励反馈和人类介入训练,还能从异构数据学习,实现自我进化。

量子位
算法论文8

谷歌新研究:模型“吵架”有利于提升推理质量

谷歌新研究发现高级推理模型自发进化出'思想社会',研究人员用LLM - as - judge方法识别出多个虚拟人格。还找到控制现象的'开关',实验表明教AI'吵架'更有效,其'社交技能'通用,给开发者带来新启示。

AI工程化
推荐文章7

“煽风点火”让模型“卷”起来的提升性能的套路

网友Greg Isenberg分享让AI提升性能的方法,通过利用不同AI模型如ChatGPT、Claude、Grok间的“竞争”,人为制造竞争环境,激发其潜力,可提升输出效果,且方法获很多网友验证认可。

AI工程化
新闻资讯8

全球首份模型业绩报!MiniMax预判2026三超级PMF,AI平台公司启程了

港交所上市52天,MiniMax交出IPO后首份年报,2026年2月ARR突破1.5亿美元,2025年营收同比增158.9%,毛利飙升437%、亏损率收窄。它产品密集迭代,还预判2026年有三个超级PMF,欲成AI平台型公司。

量子位