「Qwen3模型」共找到 8618 篇相关文章

产品应用7

从 Copilot 到 通用 Agent : 阿里在 AI Coding 上的应用和挑战

阿里巴巴代码平台负责人向邦宇在 QCon 大会分享阿里智能研发大模型应用与挑战。介绍探索成果,如代码补全、审查等功能;指出面临用户需求理解、领域知识整合等难题;还提及技术进步带来新机遇,促使从 Copilot 向 Agent 转变。

InfoQ
算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
8

10万字Claude系统提示词泄露!我用DeeSeek 将它翻译成了中文版

Claude完整系统提示在GitHub泄露,虽真假未确认,但值得分享供参考。作者用DeepSeek将其翻译成中文版,该提示涵盖模型行为、工具使用等多方面,设计精妙全面,是AI交互设计“百科全书”,对提示词工程师极具学习价值。

AGI Hunt
产品应用8

用GPT-6 Astra就能直接控制机器人?可具身真机没那么简单

本文讨论GPT-6 Astra接入机器人控制取得亮眼单项成绩,但真机测试暴露不安全不稳定问题,介绍穹彻智能发布的开源RoboRSI多智能体自进化框架,解决具身智能落地核心痛点,探讨大模型时代具身智能行业的发展方向

机器之心
产品应用7

出了两道真题考 GLM-5.2,Opus 4.8 和GPT 5.5 陪跑

作者对GLM - 5.2、Opus 4.8和GPT 5.5进行两项测试。一是审计Skill体系,GLM - 5.2覆盖skill数多、找出冲突多,还挖出bug;二是做世界杯夺冠推演器网站,Opus表现出色,GLM - 5.2省token,Codex有巧思但结构有缺陷。

AI产品黄叔
算法论文8

T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」

在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。

机器之心
开源动态8

1.2K Star!终于有工具开始认真解决 AI Agent 安全问题了!

作者深度使用AI Agent时担忧其安全性,GitHub上斗象科技开源的ClawVault项目,上线不久获1.2K Star。它为AI Agent提供多场景安全隔离方案,有分格管理、可视化监控等实用设计,适配Python3.10+环境,安装方便。

开源星探
新闻资讯7

AI第一金主黄仁勋:日均花掉20亿

AI投融资火热,黄仁勋成最大金主。过去财年英伟达投资175亿美元,今年已投400亿。投资风格是大手笔、广撒网,涵盖AI模型、算力、硬件等。偏爱OpenAI,投300亿,但与各实验室关系复杂,投资也有商业考量。

量子位
新闻资讯7

AI失忆症有了新解法,哈佛团队开发海马体仿生技术,要用AI终结人类“遗忘史”

近日,AI初创公司Engramme被曝正与投资者接洽融资约1亿美元,潜在估值达10亿美元。其联合创始人是哈佛教授加布里埃尔·克雷曼,技术基于其实验室成果,自研大记忆模型LMMs,已开放记忆API内测申请。

DeepTech深科技