「跨领域数据」共找到 4172 篇相关文章
视觉语言模型“扫地僧”:360低调开源FG-CLIP2登顶29项全球基准测试 | 甲子光年
两周前,360人工智能研究院低调开源FG - CLIP2,它在29个公开基准测试中超越Google和Meta的模型。该模型实现局部细粒度识别和原生双语对齐,为AI视觉理解设新基准,已服务开发者并在多领域落地。
超越GPT-4o和Gemini 2.5!小米MiMo-Audio音频大模型真香
小米推出MiMo - Audio大模型,预训练数据超1亿小时。它在多个基准测试成开源7B模型SOTA,开放相关资源。分词器表现佳,有全新架构,在音频理解、对话、推理等方面表现出色,还集成TTS功能。
智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强
智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。
普林斯顿团队领衔发布最强开源数学定理证明模型:32B性能大幅超越前代SOTA DeepSeek 671B
近日,普林斯顿大学牵头多机构推出开源数学定理证明模型 Goedel-Prover-V2。其 32B 旗舰模型在多基准测试超 DeepSeek-Prover-V2-671B,8B 小模型特定基准性能与之持平。该模型有三项关键创新,团队已公开模型及数据集。
万亿市值一夜蒸发!Claude Cowork血洗全球软件业,老黄急了
Anthropic为Claude Cowork植入「插件」功能,引发全球软件股恐慌。短短一夜,硅谷软件巨头蒸发3000亿美金,过去一周全球近万亿美金市值没了。Claude插件覆盖多领域,取代传统软件,让SaaS商业模式面临崩塌。
毫无征兆!DeepSeek R1爆更86页论文,这才是真正的Open
两天前,DeepSeek悄无声息把R1论文从22页更新到86页,将其升级为开源社区可复现的技术报告。新论文干货多,如精确数据配方、基础设施说明等,且多项实力媲美甚至赶超OpenAI等闭源模型。
ICML 2025杰出论文出炉:8篇获奖,南大研究者榜上有名
本周一,ICML 2025公布最佳论文奖项,共8篇获奖,含6篇杰出论文奖、2篇杰出立场论文奖,南京大学研究者上榜。大会投稿量持续增长,展示AI领域火热。文中介绍了各获奖论文的研究内容与成果。
马斯克发布“地球最强AI模型”Grok 4:横扫所有榜单,在“人类最终测试”超越人类博士”!
北京时间7月10日,马斯克团队发布Grok 4,其基准测试成绩惊人,在‘人类最终测试’等表现出色。它成功源于多智能体协作、追求真相哲学和高算力投入,还在多领域展现应用潜力,同时公布定价并坦言短板。
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4
近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。
获NVIDIA致谢:悟空Agent的实践、复盘与迭代
本文以悟空Agent获NVIDIA致谢为切入点,介绍多智能体架构闭环及实战挑战,如上下文断流、调度失衡。还阐述架构设计、迭代优化、数据飞轮体系,指出AI infra存在安全隐患,强调安全融入业务的重要性。