代码补全」共找到 3409 篇相关文章

算法论文8

腾讯混元 TurboS 技术报告首次公开:560B 参数混合 Mamba 架构,自适应长短链融合

日前腾讯混元 TurboS 技术报告公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。

InfoQ
推荐文章7

自构建智能体:一项 LangChain4j 实验

作者将LangChain4j文档交代码助手,让其参照构建智能体,设计多智能体系统编写、测试和调试代码。实验展示了LangChain4j优势,还对比监督者和工作流两种智能体实现模式,揭示速度与自主性权衡关系。

InfoQ
开源动态8

开源版MetaQuery来了!OpenUni用1.1B参数媲美BLIP3-o-8B,数据代码开源

南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数达 8B 模型性能,代码、权重、数据开源。它架构极简、参数高效,还继承了多模态理解能力。

机器之心
新闻资讯7

AI圈两件大事,Meta超级智能实验室大规模裁员,OpenAI新发布的浏览器遭网差评。

近期AI圈热闹非凡。Meta超级智能实验室裁员600人,包括资深人员田渊栋,或因前期扩张致团队臃肿。而OpenAI新发布的浏览器Atlas仅Mac版,口碑差,功能不新鲜,产品成熟度和体验欠佳。

开源AI项目落地
推荐文章8

“我一行代码都没读就发布了”,被OpenAI收购后,uv工具创始人开始反思AI编程

Python 开发者工具领域经历革命,Charlie Marsh 打造 Ruff 和 uv 后被 OpenAI 收购。他反思 AI 编程,探讨其对软件工程的重塑,还分享开发、创业经验及应对 AI 挑战的策略。

AI前线
新闻资讯7

是套路!英伟达千亿美元投OpenAI,奥特曼拿钱买卡还让甲骨文赚差价

英伟达计划向OpenAI投资最高1000亿美元,OpenAI要用这笔钱构建至少10GW的AI数据中心,用英伟达系统。首笔100亿预计2026年下半年投入。此外还存在甲骨文参与的“三角财富循环”。

量子位
产品应用7

高考数学卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。

机器之心
开源动态8

字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手

传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。

深度学习自然语言处理
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是模态模型。此外还有多个新模型,构建场景生态。

开源星探
算法论文8

“掩码即武器”,四款扩散LLM部破防 ? 上交&上海AI Lab发现dllm致命安缺陷

上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安

深度学习自然语言处理