大模型数据」共找到 9981 篇相关文章

算法论文8

别被室内基准高分骗了:模型是在推理空间,还是在「背答案」?

2025年,空间智能成模型竞争新热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院学等机构发布OSI - Bench重新审视模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
算法论文8

模型幻觉的源头找到了!清华团队锁定模型宁愿说谎也要讨好人类的神经元

清华学研究团队深度解剖语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
新闻资讯7

模型的新战场在推理?——《推理模型综合测评报告 2025》深度解析 | 直播预告

5月29日,InfoQ研究中心发布《推理模型综合测评报告2025》,通过五维度、五题型的300道测试题对八家主流推理模型全面测评,还总结各维度表现,梳理技术前置因素与趋势。6月6日有直播解读。

InfoQ
新闻资讯8

腾讯调整模型组织架构:姚顺雨加盟,向总裁刘炽平汇报

腾讯宣布模型组织架构调整,姚顺雨加盟。他是模型Agent方向青年研究者,将任“CEO/总裁办公室”首席AI科学家等职。腾讯强化研发体系,混元模型成果多,AI产品有竞争力,内部推进AI变革。

量子位
算法论文8

不靠英伟达,中科院在国产 GPU 上跑通 76B 类脑模型

过去模型依赖Transformer和NVIDIA GPU体系,硬件自主化难。中科院团队提出类脑模型SpikingBrain,在超长文本处理上百倍加速,在国产MetaX GPU平台稳定训练76B模型,开辟新道路。

AI科技评论
开源动态8

135 个项目、七趋势、三赛道:撕开模型开源生态真相,你会怎么卷?

在开发者会密集登场之际,5月27日蚂蚁集团开源团队发布《2025模型开源开发生态全景图》。展示135个项目、七趋势、三赛道,剖析开源生态现状与变化,揭示应用重塑和生态位博弈。

机器之心
开源动态8

打破数据质量鸿沟!清华腾讯Bee项目发布1500万高质量数据集,刷新MLLM全栈开源SOTA

全开源多模态模型性能被闭源和半开源模型“卡脖子”,根源在于数据质量。清华与腾讯混元团队推出Bee项目,有三核心贡献,产出的Bee - 8B模型表现领先,证明保证数据质量比堆量更有效。

量子位
开源动态8

4B小模型数学推理首超Claude 4,700步RL训练逼近235B性能 | 港&字节Seed&复旦

香港学NLP团队联合字节跳动Seed、复旦学发布Polaris强化学习训练配方,让4B模型数学推理能力超商业模型,且Polaris-4B可在消费级显卡部署,相关内容已全部开源。

量子位
开源动态7

不可思议!400B模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上模型交互级速度运行。

机器之心
推荐文章8

0 融资、10 亿美元营收,数据标注领域真正的巨头,不认为合成数据是未来

Surge AI创始人Edwin Chen接受访谈,提出创业应解决问题而非融资,合成数据被高估,高质量数据才是壁垒。他还指出语言模型竞技场误导训练方向,人类反馈永不过时,数据质量是AI发展首要瓶颈。

Founder Park