大模型竞争」共找到 9537 篇相关文章

开源动态8

Qwen3新成员:Embedding系列模型登场!

今天正式发布Qwen3-Embedding系列模型,专为文本表征等任务设计,继承Qwen3多语言理解优势。在多项基准测试表现卓越,已在多平台开源,有卓越泛化性、灵活架构与多语言支持等特点。

通义千问Qwen
新闻资讯7

辍学潮来了?19、20 岁年轻人“逃离”教室去 AI 创业,20 多年创业佬断言:他们的机会比

云存储公司 Box 创始人 Aaron Levie 称,19、20 岁年轻人很多辍学投身 AI 创业。他认为 AI 让初创公司生产力幅提升,巨头优势不再,年轻创业者迎来黄金机会,还分享了创业建议。

AI前线
推荐文章7

2026 将近,世界模型到底更「世界」了吗?

近期 Runway 发布相关产品,让「世界模型」讨论再聚焦。其定义从强化学习语境延伸,业内理解不断变化,概念边界变模糊。如今被推到和 LLM 同级,出现概念同名但内核分裂现象。

机器之心
开源动态7

any-llm:又一个统一模型服务接口的Python代理库

Mozilla AI开发的开源项目any-llm,解决多LLM提供商接口统一问题,能让开发者用一个接口调用不同语言模型。它吸取此前产品长处,有统一接口等优势,使用和安装简单。

AI工程化
产品应用8

Codex 更新:一个 AI,接管你所有软件。

Codex 迎更新,有望成 OpenAI 超级应用核心。它能与多工具协作,超 300 万开发者在用,近半使用场景非写代码。具备跨应用多 Agent、非编码任务处理等功能,还增添图像生成等特性。

AI进修生
开源动态8

DeepSeek开源的不仅仅是个新OCR模型。。。

DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。

AI工程化
新闻资讯7

《时代》2025重塑世界的五AI进展

本文讲述2025年AI重进展。中国Deepseek R1开源模型冲击全球格局,AI具备思考能力,特朗普政府推“星际之门计划”,AI公司支出逼近1万亿美元,同时AI与人类关系更复杂,引发风险思考。

AIGC开放社区
开源动态7

The Batch: 907 | 小而高效模型的“制作”方法

Mistral AI发布Ministral 3系列模型权重,结合剪枝与蒸馏技术,用级联蒸馏法构建。该系列参数规模有140亿、80亿和30亿,在部分测试中表现佳,训练成本低于传统方式。

DeeplearningAI
新闻资讯7

Ilya的第一个模型,被曝本月上线

新智元报道,投资人Gavin Baker称Ilya Sutskever创立的SSI本月将发布首个模型。他还提及持续学习等技术或影响英伟达显卡需求,且指出Claude成华尔街“克朗凯特”,带来市场共识同质化。

新智元
产品应用7

实测Kimi全新Agent模型「OK Computer」,很OK

Kimi发布全新Agent模型「OK Computer」,依托Kimi K2,能搭网站、做PPT、处理量数据。实测显示它在设计、生成、分析类任务表现不错,设计无需找素材,分析无需想角度,生成还能推荐风格。

量子位