「大模型测试」共找到 9855 篇相关文章

推荐文章8

前 Codex 大神倒戈实锤!吹爆 Claude Code:编程提速 5 倍,点破 OpenAl 死穴在上下文

OpenAI Codex 早期研发者 Calvin French - Owen 在播客中锐评代码智能体,偏爱 Claude Code,称其搭配 Opus 模型写代码速度提 5 倍。他强调上下文管理重要性,还对比了 Claude Code 与 Codex 产品理念差异。

AI前线
新闻资讯7

突发!ChatGPT官宣加入广告,既然无法用爱发电,那就让 AI 带货吧。

OpenAI官宣在免费版和8美金新订阅的ChatGPT中测试投放广告,仅针对美国登录用户。此前ChatGPT APP负责人称不会加广告,如今被打脸。OpenAI因运营成本高、亏损多,选择广告变现。

开源AI项目落地
推荐文章7

a16z:2026 年的 AI 应用生态,关键问题是这几个

a16z投资人Anish Acharya探讨2026年AI应用生态关键问题。他指出应用和模型分化将更明显,未来AI应用是组合体。还提到工具本质会变,企业部门要软件优先,应用层创业公司有多种优势。

Founder Park
算法论文8

142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要

文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。

GiantPandaLLM
开源动态8

从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限

今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。

机器之心
推荐文章8

DeepSeek V3到V3.2的进化之路,一文看全

知名AI研究者Sebastian Raschka发布深度博客,详细梳理DeepSeek V3到V3.2进化历程。DeepSeek V3.2性能对标GPT - 5和Gemini 3.0 Pro,且为开放权重模型,报告涵盖众多有趣领域和知识。

机器之心
开源动态8

首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS

EverMind团队发布面向人工智能智能体的长期记忆操作系统EverMemOS。它在主流评测集表现超此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。

机器之心
产品应用8

当搜索遇见 AIGC:京东零售的“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并预告新能力,推动电商个性化变革。

InfoQ
新闻资讯7

390亿美元,全球具身智能第一估值来了!英伟达持续加注中

与OpenAI分道扬镳后,Figure C轮融资获超10亿美元承诺资本,投后估值达390亿美元。资金将用于扩大人形机器人大批量制造与部署、搭建GPU基础设施、启动数据采集项目,助力具身智能发展。

量子位
新闻资讯8

“连我也要被GPT-5踹了!”Altman再发暴论:写款软件就花7毛钱,大批高级程序员岗也说没就没

OpenAI 首席执行官 Sam Altman 在播客和会议上谈 GPT - 5,称其“几乎所有方面比人类聪明”,还预言 AI 对就业、医疗等领域影响大,也指出 AI 有欺诈等风险,强调其发展不确定性。

InfoQ