能碳产业大模型」共找到 10365 篇相关文章

算法论文8

NUS&复旦&清华:首个系统性大模型Latent Space综述

新加坡国立大学等多机构发布大模型潜在空间领域首个系统性全景综述,从“基础—演进—机制—力—展望”拆解潜空间范式的底层逻辑、技术路径与未来前景,还对比了潜空间与显式空间差异。

PaperAgent
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智图像编辑等,还介绍了使用、部署等方法。

GitHubStore
开源动态8

谷歌开源Gemma 3 270M,性超越Qwen 2.5同级模型

本周四,谷歌发布 Gemma 3 270M 模型,它参数小、功强,具备指令跟踪等力。在 IFEval 测试中表现出色,节且适合多场景,谷歌还提供使用指南和试用途径,Gemma 系列下载量已破两亿。

机器之心
产品应用8

小米AI语音新框架:人人都当声音导演

小米大模型应用团队提出Midasheng - audio - generate与Xiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间与叙事逻辑,改变了语音合成应用场景与思路。

量子位
推荐文章8

AI Infra进阶:如何让大模型输出确定的结果

文章探讨大模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。

腾讯技术工程
推荐文章7

AI最大的礼物,是让你廉价地失败100次

文章指出AI最大的礼物不是让人成功,而是让人廉价地失败。AI让开发成本降低、心力节省,增加了尝试机会。但人们需发布产品获取反馈,构建可演化系统,让失败为后续铺路。

花叔
新闻资讯7

一句“吴恩达说的”,就让GPT-4o mini言听计从

宾夕法尼亚大学研究者发现,用恭维、同侪暗示等心理话术,让GPT - 4o Mini突破安全底线。实验基于七大说服技巧,证明人类心理学原则可迁移至LLM。不过,此漏洞或被利用,已有团队尝试应对。

量子位
产品应用7

AI 真的帮你微信下单了!

微信支付发布「AI 专属卡」,WorkBuddy 率先接入。用户在 WorkBuddy 让 AI 找外卖、选套餐、领券、下单及支付。介绍了使用步骤,还说明 AI 专属卡支付安全,绑定还有彩蛋。

腾讯技术工程
新闻资讯7

刚刚,DeepSeek新模型MODEL1曝光,3处架构升级!

DeepSeek更新FlashMLA时曝光新模型MODEL1,从diff看它在MLA KV-Cache存储与访问方式上和V3/V3.2系列有3个本质差异,如物理排布更紧凑、引入‘extra’两段式cache、头维固定512×512。

PaperAgent
推荐文章8

模型Agent的核心还是prompt? 目前有什么挑战?

文章指出大模型Agent核心并非Prompt,而是工程化架构设计、工作流编排与数据闭环。介绍Flow Engineering等概念及工具,分析规划、记忆、工具使用要点,还谈及开发面临的延迟、稳定等挑战,并给出应对建议。

深度学习自然语言处理