能碳产业大模型」共找到 10434 篇相关文章

新闻资讯7

Mistral AI发布一站式编程助手Mistral Code

法国开源大模型平台Mistral AI发布一站式编程助手Mistral Code,旨在解决企业开发人员使用AI编码工具时的合规与安全障碍。它基于Continue开发,集成四个大模型,还在私有代码库微调,获早期客户认可。

AIGC开放社区
产品应用7

没绷住...美团竟然做了个这?

美团推出产品 xia345,它聚合主流 AI Agent 客户端、技市场和 LLM 模型等信息,功不复杂但信息密度高。其有清晰新手路径,还成 Agent 技。产品经理规划了新功,目标成 Agent 时代迪士尼乐园。

特工宇宙
推荐文章7

大厂的AI不限量补贴终会结束!Hermes Agent作者:开源框架真正的狠招是把Claude对Anthropic的忠诚抢过来

科技创作者 Peter Yang 对话 Hermes Agent 作者之一 Karan Malhotra,探讨 Hermes Agent 与其他产品的差异、模型谄媚问题、开源意义等。Karan 指出其独特自我改进系统与专注用户需求特点,还提及让模型更贴合用户的方法。

AI科技大本营
新闻资讯8

ChatGPT语音杀入桌面!你负责动嘴,一群AI负责干活

近日OpenAI将ChatGPT语音功正式引入桌面版,其底层是新一代语音模型GPT - Live。大佬们看好语音输入,因其高带宽传递上下文。该功不仅闲聊,还可调度智体,OpenAI想让ChatGPT成AI工作操作系统。

新智元
推荐文章8

甲小姐对话程路:做源领域的“自动驾驶”|甲子光年

本文是甲小姐对话新奥源程路,探讨源领域“自动驾驶”。程路认为源转型正当时,AI是关键。新奥泛网构建数字源运营系统,提出“源领域的自动驾驶”分级概念,还介绍了数据处理、算法及落地应用等情况。

甲子光年
算法论文8

14B打败671B!微软rStar2-Agent在数学推理上超过DeepSeek-R1

如今的大语言模型推理力关键在于测试时扩展,但长思维链有局限。微软研究团队用主动式强化学习探索,成果 rStar2 - Agent 方法训练出 14B 的 rStar2 - Agent - 14B 模型,性超 671B 的 DeepSeek - R1。

机器之心
推荐文章7

LLM提示三剑客:解密CoT、ReAct、DSP如何提升AI准确率?

LLM提示分思维链(CoT)、ReAct和声明式自我提示(DSP)三类。CoT鼓励模型推理,适合多步骤复杂问题;ReAct结合推理与动作,是代理基础;DSP让模型声明计划,用于模块化任务。还给出使用场景与对比。

CourseAI
算法论文8

DeepSeek比你更懂反思!谷歌重磅发现,智的本质竟是一场社会化对话

谷歌等机构研究发现,像DeepSeek - R1等推理模型思考复杂问题时,内部模拟多角色辩论赛,形成思维社会机制,让AI准确率提升,证明智本质或是内化社会互动,还为调优AI提供新方法。

AIGC开放社区
算法论文8

告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍

视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。

机器之心
算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理