大模型开发」共找到 10003 篇相关文章

开源动态8

狂涨26.5K star!一个接口搞定20+AI模型,开箱即用,太香了!

文章介绍开源项目One API,它是LLM API管理与分发系统,能统一管理主流AI模型,用一个接口搞定调用。有友好界面和可视化操作,在Github获26.5K star,还介绍其性能特色、安装使用方法。

开源先锋
新闻资讯8

云栖会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI
开源动态8

首个代码世界模型引爆AI圈,能让智能体学会「真推理」,Meta开源

Meta重组后的AI部门推出首个代码世界模型CWM,是320亿参数开放权重LLM。它与传统模型思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究。

机器之心
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了

过去两年模型推理能力跃迁,谷歌等机构研究指出,推理能力提升源于模型推理时隐式模拟类多智能体交互结构“思维社会”,还提出利用“群体智慧”新方向,并介绍了研究方法、实验结果等。

AINLPer
开源动态8

DeepSeek重磅开源3B OCR模型,一天处理20万页文档!一天内斩获6K标星!

DeepSeek开源3B OCR模型DeepSeek - OCR,参数量仅30亿,单张A100 - 40G一天能处理20万页文档,不到24小时获6K标星。它是视觉压缩引擎,解决模型处理长文本算力爆炸问题,有诸多技术亮点。

开源星探
新闻资讯7

刚刚,全球最难考试惊天反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
产品应用8

英伟达祭出NVFP4核弹:模型训练根本性转变,GB300效率狂飙7倍

英伟达推出新格式NVFP4,能以4 - Bit速度与效率实现16 - Bit生产件级训练精度,是LLM开发飞跃。虽处于研究阶段,但正与多组织合作。还介绍其方法、优势,实验也证明它在规模训练的有效性。

AI寒武纪
开源动态8

Mini-SGLang,30万行代码浓缩为5000行,模型推理高性能教学与研究模版

SGLang发布Mini-SGLang,将30万行代码缩至5000行,保留核心特性,为模型推理提供高性能教学与研究模版,解决教育门槛高和科研原型开发难的痛点,还经测试验证了性能。

AIGC开放社区
算法论文8

NUS、牛津等联合发布音视频智能综述:系统梳理模型时代的AVI全景图

NUS领衔近10家机构发布音视频智能综述,系统梳理模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。

新智元
算法论文8

用「进化+压力测试」自动生成的竞赛级编程题,各家模型谁更hold住?

北京学与通用人工智能研究院联合提出 UniCode 框架,构建进化式评测系统,能自动生成高质量算法题目与抗污染测试用例。通过对 19 个前沿模型测试,展现高挑战性与强判别力,为代码能力评估开辟新路径。

机器之心