语料规模」共找到 454 篇相关文章

推荐文章8

LLM省钱大测评!48块GH200,首个百亿级参数量实证

EfficientLLM项目聚焦LLM效率,提出三轴分类法和六大指标,实验覆盖多方面。研究表明效率优化需权衡,最优策略因任务和模型规模而异,且相关技术可迁移到跨模态模型,成果将开源。

新智元
新闻资讯7

刚刚,Anthropic切断OpenAI对Claude的访问权限

Anthropic周二切断OpenAI对Claude模型的API访问权限,因OpenAI技术人员通过API大规模用Claude Code写代码,违反服务条款。Anthropic曾有类似操作,网友对此事看法不一。

AGI Hunt
开源动态8

腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!

腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。

量子位
算法论文8

清华AI找药登Science!一天筛选10万亿次,解决AlphaFold到药物发现的最后一公里

清华大学团队在Science发表论文,研发AI驱动的超高通量药物虚拟筛选平台DrugCLIP。它24小时能完成10万亿次蛋白–分子配对计算,打通从AlphaFold到药物发现通道,完成人类基因组规模筛选,数据已开放。

量子位
新闻资讯8

ICCV 2025最佳论文出炉!何恺明、孙剑等十年经典之作夺奖

ICCV 2025公布奖项,CMU团队凭BrickGPT获最佳论文,以色列理工学院团队FlowEdit获最佳学生论文。何恺明等十年前论文获Helmholtz Prize。大会规模超往届,投稿11239篇,录用2500 + ,超半作者来自中国。

新智元
新闻资讯7

疯狂小扎边裁员边给高管发钱!元宇宙硬件成重灾区

据纽约时报等报道,Meta近日一边裁700人,涉及多部门,内部还评估更大规模调整;一边为6位核心高管设股权激励,收益与股价挂钩。这源于AI烧钱,Meta要开源节流,优先AI等现实方向。

量子位
开源动态8

智源研究院发布中英文高质量数据集CCI4.0,推动全球人工智能开源创新

2025年5月6日,智源研究院在全球开源创新论坛发布中英文高质量数据集CCI 4.0,同步在多平台开源。CCI 4.0规模大,处理严格,此前CCI系列反响好,未来将持续建设中文预训练语料库。

AI科技大本营
新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
新闻资讯7

她拒了贝索斯,离开黄仁勋,只为回答一个问题:AI能学会物理世界吗?

近日,AI初创公司Accelerated Understanding亮相,由Anima Anandkumar夫妇创立。它未随主流,目标是训练模拟物理现象的通用AI模型。该模型处理数据规模大,公司想解决AI验证瓶颈,产品面向科研工程机构。

DeepTech深科技
算法论文8

无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%

西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。

机器之心