推理策略」共找到 2761 篇相关文章

开源动态8

SGLang支持GPT-OSS:从Day 0支持到性能增强

SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。

GiantPandaLLM
新闻资讯7

刚刚,DeepSeek最新发文!V3/R1训练细节全公开,信息量巨大

网信办新规生效,DeepSeek回应,标注AI生成内容,公开V3/R1训练细节。介绍训练分预训练和优化训练,深挖数据使用,还谈及推理、开源情况,也提到对抗AI幻觉与滥用风险的措施。

新智元
算法论文8

最新视觉大模型 DINOv3论文精读(逐段解析)

DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
新闻资讯8

OpenAI高管自爆:Scaling不死,GPT-5「双轴训练」撕开智能天花板

OpenAI首席运营官Brad Lightcap在对话中揭秘GPT-5,其能自主判断是否深度推理再作答,体验全面升级。训练方式有后训练,Scaling Law仍成立,未来从两轴改进。还探讨了AGI、应用场景等。

新智元
算法论文8

ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测

北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。

机器之心
新闻资讯7

加一个字母就可以绕过AI围栏,新的漏洞:TokenBreak

提示词注入攻击威胁大模型及应用,当前主要防护方法是用BERT模型检测。HiddenLayer团队发现TokenBreak漏洞,通过加字母绕过检测。研究表明BPE和WordPiece分词策略易受攻击,Unigram不易,建议优先选Unigram类模型。

AI与安全
算法论文8

UNC | 发布Bifrost-1,构建“最强大脑”与“顶级画师”的桥梁,低成本实现“文生图”自由

随着AI发展,打造能推理又能创作的系统成为焦点。但让LLM学习视觉创作面临训练成本高和能力受损问题。BIFROST - 1框架在MLLM和扩散模型间建通信信道,解决核心痛点,实验表现出色。

AINLPer
推荐文章7

扩散架构 or「NoThinking」,AI 对话的「1Hz 壁垒」如何突破?

当红通用人形机器人公司 1X 的 AI 副总裁 Eric Jang 提出「智能频谱」概念,阐述当前 AI 面临的「1Hz 壁垒」及实现「Ultra Instinct」能力的先决条件。不同推理方案有望解决部分问题,但通用智能体仍有瓶颈。

机器之心
8

ART:构建可靠智能体的强化学习新框架

现有AI智能体在真实场景表现不稳定,阻碍其应用走向生产。ART开源强化学习框架诞生,通过分离“前端”与“后端”、兼容OpenAI推理端点等创新化解困境,还给出使用方法,在案例中展现强大效能与经济性。

AI工程化
产品应用8

让大模型“跑”在手机里:vivo蓝心端侧部署创新揭秘,性能功耗双优!

在AICon2025上海站,vivo AI研究院工程师章苏迟分享蓝心大模型端侧部署方案。介绍端侧大模型优势及应用场景,阐述内存、性能、功耗等指标优化方法,还提及多业务场景应对策略与安全合规措施。

InfoQ