GPT - 4o Mini」共找到 1082 篇相关文章

8

全网最强万字解读:DeepSeek-V4 掀翻了谁的桌子? | GAIR live 030

文章深度解读了DeepSeek-V4,从产业、生态和架构维度拆解其效率账本。它成本低,补齐短板适配昇腾芯片,但极致省钱也有代价,如性能衰减、架构复杂等。还探讨了长上下文、MoE与稠密模型路线差异及商业化潜力。

AI科技评论
算法论文8

大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题

GPT - 4o开启全能交互时代后,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。

机器之心
开源动态8

Meta刚刚开源的SAM 3D火爆全网,未来2D=3D。

近日AI圈热闹,GeminiGPT、Grok相继更新,Meta虽未更新小羊驼,却发布开源3D模型SAM 3D。它能精确重建人或物体3D模型,有真实三维感知,有两模型,性能强,应用场景多。

开源AI项目落地
产品应用7

OpenAI很看好!首个SWE-1模型发布,软件开发或将提速99%

Windsurf发布首个前沿模型SWE-1,目标将软件开发提速99%。它不只能写代码,还能协助软件工程流程。有三个系列模型,SWE-1运行成本低,SWE-1-lite对所有用户开放,SWE-1-mini适用于低延迟场景。

新智元
新闻资讯7

时隔两月,Mistral AI终于上新Medium 3,近期还有「One more thing」

时隔两月,Mistral AI 推出 Mistral Medium 3,性能介于轻量级和大规模模型间,优于 GPT - 4o 等。未开源,可通过官网等使用,专为企业设计,成本低。还预告将推「大型」产品,同时推出企业聊天机器人 Le Chat Enterprise。

机器之心
产品应用7

DeepSeek V4正式版太便宜辣!5毛钱做出3D射击游戏,网友直呼绷不住

DeepSeek V4 Flash正式版API上线公测,其价格便宜得离谱,如0.07美元就能制作第一人称3D射击游戏。与Claude Opus 5、GPT - 5.6等对比,功能相近但成本低很多。它靠MoE架构等降低成本,还提升了性能。

量子位
开源动态8

13小时不眠不休,300个分身狂敲代码!开源第一易主了

4月20日深夜,Kimi K2.6出道即开源,展示了强大的「全栈交付」能力,跑分超GPT - 5.4等。它能完成多类型官网制作,300个Agent协作能力强,还能复刻高盛研报、交付三件套,其Claw群组开启小范围测试。

新智元
产品应用8

智谱GLM-5.1深度评测:8小时连续工作,开源大模型进入"工程交付"新纪元

2026年4月8日智谱发布GLM-5.1,它是全球首个通过真实工程任务验证8小时持续工作能力的开源模型,在SWE-Bench Pro上超越GPT-5.4等登顶。该模型性价比高、技术创新多,还适配国产硬件,开源生态友好。

机器学习AI算法工程
算法论文8

OCR 发生了一件反直觉的事

百度 PaddleOCR 团队的 500 万参数模型 PP - OCRv5,在文字识别准确率上可与 Qwen3 - VL、GPT - 4o 等巨无霸模型抗衡。团队挑战‘模型越大,效果越好’,认为 OCR 中数据质量比参数重要,通过实验证明并优化数据。

CourseAI
算法论文8

ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像在统一架构中共同演化

NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像在统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或超 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。

机器之心