GPT-4.1」共找到 3440 篇相关文章

开源动态8

4B参数实现理解、推理、生成、编辑一体化!InternVL-U重磅开源

上海人工智能实验室联合多所高校开源多模态一体化模型 InternVL-U,仅 4B 参数,突破现有统一多模态模型瓶颈,在复杂场景超越 14B 级模型,已全面开源,提供推理代码等。

OpenMMLab
新闻资讯7

Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想

新智元报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。

新智元
新闻资讯8

中国AI芯片大突围,DeepSeek V3.1引爆算力革命

DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。

AIGC开放社区
新闻资讯7

GPT-5.6紧急叫停!OpenAI最强模型被迫「一客一审」

因网络安全考量,OpenAI最强模型GPT-5.6被紧急叫停,进入「逐个审批」时代,先有限预览,客户访问权限逐一审批。开发者已发现其相关代码,它在前端UI设计等方面实力大涨,但发布开关被拿走。六月三大旗舰模型集体卡壳。

新智元
开源动态8

1.2万人收藏单日斩获 3.4K!刚刚冲上 GitHub Trending 榜首的“AI 红队”工具!

AI加速代码编写,但也留下更多安全坑,传统扫描工具和人工渗透测试难以应对。新晋GitHub Trending榜首工具Shannon是全球首个开源全自动AI渗透测试员,多智能体架构,功能强大,适合AI编程团队。

开源星探
算法论文8

清华校友出手,8B硬刚GPT-4o!单一模型无限工具调用,终结多智能体

MIT等机构推出TIM和TIMRUN组合拳,突破模型token天花板。TIM将推理建模为任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模型高效推理,简化智能体构建,在多方面表现出色。

新智元
开源动态8

我去,真牛!Coze Studio 开源版究竟有多火?看 GitHub 最新 1.4k star 人气飙升!

Coze Studio是低代码、可视化的AI Agent开发平台,有Apache‑2.0开源许可,降低使用门槛。它能解决非专业开发者、企业等构建智能对话助手的痛点,核心功能亮点多,应用场景广,在国产AI Agent开发生态潜力大。

小华同学ai
开源动态8

7B模型“情商”比肩GPT-4o,腾讯突破开放域RL难题,得分直翻5倍

腾讯混元AI数字人团队提出RLVER框架,解决开放域RL在真实交互中的‘情商’优化困境。经其训练的Qwen2.5 - 7B模型在情感对话基准得分跃升,比肩顶级商用模型,团队还有诸多启发性发现。

量子位
新闻资讯7

OpenAI发布新模型 GPT-Rosalind:专攻生物学、药物发现和转化医学

OpenAI发布生命科学前沿推理模型GPT - Rosalind,目标是生物学研究等领域。它是生命科学模型系列首款产品,在多方向表现强。当前以研究预览版向特定合作机构开放,有意机构可申请。

AI寒武纪
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI