「空间理解能力」共找到 4080 篇相关文章
抖音&LV-NUS开源多模态新模,以小博大刷新SOTA,8B推理比肩GPT-4o
抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中小参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。
永别了,人类冠军!AI横扫天文奥赛,GPT-5得分远超金牌选手2.7倍
国际天文与天体物理奥赛(IOAA)中,GPT - 5和Gemini 2.5 Pro完胜人类选手。俄亥俄州立大学团队考察五大顶尖LLM,发现它们大多达金牌水平,但在几何、时空推理等方面有困难。
NeurIPS 2025 Spotlight | 只需一条演示,DexFlyWheel框架让机器人学会「自我造数据」
北京大学、哈工大联合 PsiBot 灵初智能提出 DexFlyWheel 框架,仅需单条演示就能自动生成多样化灵巧操作数据,缓解数据稀缺问题,已被 NeurIPS 2025 接受。此框架在成本、效率和数据多样性上优势明显。
马斯克宣布开发 Grokipedia,目标超越维基百科,改善信息偏见
马斯克宣布 xAI 开发 Grokipedia,称其是对维基百科的巨大改进,也是理解宇宙的必要一步。维基百科存在左翼偏见问题,Grokipedia 旨在建立无偏见知识库,引发广泛讨论,名字也有争议。
DRAM技术发展综述:历史、技术路线图与未来展望
本文深入分析DRAM技术,追溯其历史,探讨当前格局与未来前景,比较其与SRAM优劣,考察中国主要DRAM企业发展历程并与国际同行对比,旨在提供对DRAM和SRAM生态系统的全面理解。
Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录
Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。
在上海!邀你踏入“未来分身术”的沉浸世界
2025年9月26日14:00,MANA在上海the point空间邀你体验“未来分身术”。艺术家赵博雄会带来“分身术”艺术实验,还介绍了数字艺术分身术在公共文化、演出等方面的价值及活动流程和参与方式。
Java 30周年献礼:新LTS版本Java 25,服务器内存砍掉22%,AI开发起飞
2025年9月16日,Oracle推出Java 25,这是继JDK 21后首个LTS版本,官方提供八年支持。它含18个JDK增强提案,目标是优化AI运行、安全防护等,在省内存、提速度、简语法等方面均有显著改进。
全球图生视频榜单第一,爱诗科技PixVerse V5如何改变一亿用户的视频创作
爱诗科技PixVerse(拍我AI)功能丰富,普通用户可用热门模板整活,创作者有多样创作工具。其最新V5模型在图生视频项目全球排名第一,在多方面技术革新,推动AI视频创作发展。
视频「缺陷」变安全优势:蚂蚁数科新突破,主动式视频验证系统RollingEvidence
蚂蚁数科AIoT团队论文提出主动式可信视频取证系统RollingEvidence,利用相机卷帘门效应嵌入物理水印,结合AI与概率模型验证,抵御伪造篡改,在检测准确率和防护能力上优于传统技术。