开源数据」共找到 4884 篇相关文章

新闻资讯7

英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型

英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。

机器之心
7

从 AI 招聘到数据标注,Mercor 能否打造下一个 Scale AI?

Mercor 从 AI 招聘平台转型为数据标注服务提供商,与 Scale AI 竞争。它利用早期人才招聘积累,为小规模、高难度项目提供灵活方案,虽数据质量待提升,但增长快,2025 年初 ARR 达 7500 万美元,获 1 亿美元 B 轮融资。

海外独角兽
开源动态8

这么哇塞的世界模型,竟然是开源的!

蚂蚁灵波开源通用世界模型LingBot-World,视觉效果与Genie 3不相上下且时间维度更长,能让用户深度参与,还具备一致性、记忆力等特点。它通过数据和模型层面创新炼成,结合此前开源成果构建具身智能基础设施。

量子位
开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
开源动态8

开源仅一周,鹅厂文生图大模型强势登顶,击败谷歌Nano-Banana

腾讯混元团队开源的原生多模态生图模型混元图像 3.0,开源仅一周就在国际权威评测榜单 LMArena 上超越谷歌 Nano - Banana 等,位列文生图综合和开源榜单第一。实测表现出色,技术上也有诸多创新。

机器之心
开源动态8

Code Arena全球可用模型第一!智谱GLM-5.2上线并开源

智谱上线并开源GLM-5.2,在Code Arena等平台表现优异,长任务跑分出色,架构有突破,支持100万token上下文,还引入控制功能。模型在常用编程智能体可用,适配国产算力平台,以MIT协议开源

AIGC开放社区
开源动态8

DeepMind 没舍得开源的 Genie 3,被昆仑万维放出来了

过去一周世界模型赛道热度高涨,DeepMind发布的Genie 3未开源,昆仑万维却在8月12日推出自研升级版Matrix - Game 2.0并完整开源。它定位产业化,能让世界模型从实验室走向生产线,还带来盈利模式转变。

AI科技评论
开源动态8

中科院类脑大模型SpikingBrain,2%数据,百倍速度

中国科学院自动化研究所李国齐、徐波团队发布全球首款大规模类脑脉冲大模型SpikingBrain 1.0。它处理长文本比主流Transformer模型快超百倍,训练数据仅为2%。该模型采用新架构,降低计算复杂度,还可转换现有模型,且在国产GPU完成训练。

AIGC开放社区
开源动态8

本周推荐的6个yyds的Github开源项目!

文章推荐6个GitHub开源项目。如Stretchly是休息提醒工具,助打工人养成科学节奏;Yaak是API客户端,主打离线隐私;ValueCell用于金融AI分析交易;nof1 - tracker可跟单交易;Zerox转换文档为Markdown;Open Notebook是Google Notebook LM平替。

开源先锋
新闻资讯7

Cursor“自研”模型套壳国产开源?网友:毕竟好用又便宜

美国顶流AI产品Cursor和Windsurf发布新模型,被指“套壳”中国开源大模型。Cursor新模型干活时说中文,Windsurf或用智谱GLM。中国开源模型物美价廉,在榜单和下载量上表现出色。

量子位