大模型应用开发」共找到 9687 篇相关文章

开源动态7

Qwen 3 VL 模型已并入 llama.cpp,ollama同步支持

近日,Qwen 3 VL 系列模型合并到 llama.cpp 项目,支持图像输入和多轮对话,解决了架构兼容性问题。功能已入主干分支,运行需足够资源。Ollama 最新版同步支持其本地化。

AI工程化
算法论文8

谷歌新研究:大模型“吵架”有利于提升推理质量

谷歌新研究发现高级推理模型自发进化出'思想社会',研究人员用LLM - as - judge方法识别出多个虚拟人格。还找到控制现象的'开关',实验表明教AI'吵架'更有效,其'社交技能'通用,给开发者带来新启示。

AI工程化
开源动态8

腾讯开源全新动作迁移模型FlexiAct,人物 & 动物都支持

当前动作定制方法在应对多样化主体和场景时适应性差,清华与腾讯提出FlexiAct模型。它引入RefAdapter和FAE,能在空间结构差异大或跨域场景中精准适配动作,保持外观一致,表现优于其他方法。

带你学AI
新闻资讯7

Sam Altman邮件证实,OpenAI将开发硬件语音AI Agent

今天凌晨,OpenAI的Sam Altman回应删除与Jony Ive信息一事,公布与iyO交涉邮件,透露收购io是为开发硬件语音AI Agent。iyO曾邀OpenAI投资、合作,演示失败后被弃,双方因名字打官司。

AIGC开放社区
开源动态7

记录下SGLang 开发,编译和Profile的几个小技巧

作者记录在SGLang开源一年学到的开发和Profile技巧。包括解决perfetto可视化PyTorch Profiler结果时kernel丢失问题、PR切换分支方法,还介绍让SGLang无视版本运行以定位bug的方法。

GiantPandaLLM
新闻资讯8

刚刚,Gemini 2.5 Pro升级,成编程模型新王

Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示词或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。

机器之心
产品应用8

美团之后,京东也开始自研大模型

京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。

AIGC开放社区
产品应用8

Claude Code用不了?我给你开发了一个GLM Code

Claude Code虽好用,但存在订阅难、易封号、配置麻烦等问题。作者开发了GLM Code,一行命令就能用,安装简单、价格便宜、无封号风险,能力达Claude 90%,还给出使用步骤、适用人群等信息。

花叔
产品应用8

一下午一句话 Codex 帮我开发了一个完整的游戏!

作者用 Codex 一下午开发出完整游戏《夜巡录:荒庙篇》。Codex 能力惊人,能自建角色流水线、找素材、拼素材图,还结合多个工具打磨细节。项目已开源,作者考虑将流程封装成 Skill 开源。

歸藏的AI工具箱
开源动态8

刚刚,字节开源Seed-OSS-36B模型,512k上下文

深夜,字节跳动Seed团队开源Seed-OSS系列模型,含三个版本。其用12万亿tokens训练,在多基准测试表现出色。有灵活推理预算控制等特性,原生支持512K上下文窗口,基准测试成绩佳。

机器之心