通用推理系统」共找到 4124 篇相关文章

开源动态8

Qwen-Scope:看穿大模型的“小心思”

Qwen-Scope是基于Qwen3和Qwen3.5系列模型训练的可解释性模块,通过在隐藏层插入SAE提取可解释特征。它能分析模型行为、优化模型,应用于推理、数据、训练、评估等场景,可前往Huggingface或魔搭体验。

千问大模型
新闻资讯7

用DeepSeek网页版就能瓜分鹅厂600万??!

腾讯营销以KDD Cup 2026官方赛道身份出题,聚焦推荐系统统一建模,奖金600万+。全球众多选手参与,学术和工业赛道各有冠军方案,还设创新奖。赛事也推动了鹅厂人才培养体系的拓展。

量子位
新闻资讯8

Agent工程化最佳实践,AICon深圳2026来了

8月21 - 22日,AICon全球人工智能开发与应用大会将在深圳举办。大会邀请产业一线专家,围绕Agent工程化等前沿方向,分享技术探索与工程实践,探讨AI从能力突破走向系统构建的新路径。

PaperAgent
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。

千问大模型
算法论文8

谷歌最新发表的Science论文,颠覆了人类对ASI的想象

谷歌等机构研究者在《科学》发文,提出真正智能爆炸已发生,是多元、社会性且与人类深度缠绕。推理模型内部涌现‘思想社会’,当下人机协作进入‘半人马时代’,还探讨了AI扩展、对齐及治理问题。

新智元
新闻资讯7

烧掉724亿,纳德拉挥刀重组Copilot

砸724亿美金后,微软用大重组承认Copilot「走弯路」。此前Copilot用户体验割裂,用户向竞品流失。纳德拉开出药方,统一管理,老将退场。苏莱曼转战自研大模型,微软欲让Copilot成一体化系统

新智元
产品应用8

1美金时薪雇个全栈替身,MiniMax M2.5让打工人也能体验当老板的感觉

春节档模型大战,MiniMax官宣新模型M2.5,主打智能体和Vibe Coding,性能比肩Claude Opus 4.6。它全栈能力强,能处理长链路任务,推理吞吐量高、成本低,已接管MiniMax 30%真实业务。

量子位
开源动态7

mcpx?要来拯救mcp!让工具调用不再吃掉你的上下文

MCP传统集成方式需在对话前加载所有工具定义,易使上下文溢出。开发者cs50victor基于mcp - cli构建mcpx,按需发现工具,大幅节省token,提升准确率,适合本地部署,虽有额外推理调用,但利大于弊。

AI工程化
推荐文章8

480万人围观的Claude code实战使用指南进阶来了:一文讲清Skill,子代理和MCP

Eyad发布Claude Code开发实战进阶篇,深入剖析其底层系统的Skills、Subagents和MCP connectors三大核心能力。通过对比,突出Claude Code在上下文窗口上的优势,还介绍了各功能用法及复合效应。

AI寒武纪
新闻资讯7

盘点2025年全球宕机事件,还有不用AI写代码的公司吗?

2025年Cloudflare、AWS等轮番宕机,“连坐”半个互联网。AI编程全面普及,虽提高效率,但可能让宕机更易发生、难提前发现。宕机最爱发生在变更后,AI编程使改动频繁,还让人类理解系统比例下降。

开源AI项目落地