「空间推理能力」共找到 4883 篇相关文章
Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍
Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。
9月全球值得一看的24件新媒体艺术作品
MANA平台9月分享24件全球新媒体艺术作品,涵盖12个国家,有创意反诈短片、未来零售空间、多媒体舞台等,涉及AI、混合现实等技术,展现艺术与科技融合,还开启投票助力创作者。
EMNLP2025 | LLM多次回答一致就一定正确吗?非也
随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。
“AI大神”李沐终于开源新模型,爆肝6个月,上线迅速斩获3.6k stars!
7月23日,“AI大神”李沐开源音频基础模型Higgs Audio v2,构建于Llama - 3.2 - 3B之上,预训练数据丰富。该模型在多个测评中成绩领先,有多种能力,李沐介绍其技术及训练方法。
马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?
Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。
Claude Code 强大的秘密究竟是什么?
Claude Code 强大源于其强大模型基础、丰富实用的内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI 的 Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据。
清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练
清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在多种大模型上保持端到端精度,代码将分别于6、7月开源。
国行苹果与阿里的AI 合作,正遭遇美政府狙击!
据《纽约时报》5月17日报道,白宫和国会官员严格审查苹果与阿里巴巴的AI合作计划。苹果因在中国市场销量下滑、缺乏AI功能,急需本土伙伴;而美国政府担心交易助中企提升能力等。
全球医疗榜第一,中国AI杀疯了!医疗AI迈入Harness时代
火爆的Harness架构在医疗圈落地,智诊科技发布面向医疗健康行业的Agent OS平台WiseClaw 2.0。它以健康档案为核心,有三层流水线等设计,适用于多场景,且在模型、中层能力和上层治理有优势,还获融资加速发展。
实验室造出人类精子:无精症男性或迎生育新解法
全球约2.5亿男性患不育症,其中10%-15%为无精症。美国Paterna公司宣布在实验室用精原干细胞培育出有初步受精能力的精子样细胞,形成早期胚胎,成果或助不育男性生育,不过研究尚处早期。