SpatialLM1.5」共找到 3220 篇相关文章

算法论文8

ParScale:一种全新的大模型Scaling Law

文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。

通义千问Qwen
算法论文7

LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%

最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。

新智元
开源动态7

强迫模型自我争论,递归思考版CoT热度飙升!网友:这不就是大多数推理模型的套路吗?

近日,概念CoRT火了,它在CoT基础上加了“递归思考”,能让AI递归思考响应、生成替代方案并选最优,结合“结构化自我批判”提升推理力。不过网友质疑它是“新瓶装旧酒”。

机器之心
新闻资讯8

黄仁勋放话:英伟达全员拥抱智能体!

黄仁勋称英伟达全员将配AI助手,未来AI智能体成主流。Meta小扎、微软纳德拉等也认为AI重塑开发者角色。当下AI编程工具掀起革命,虽有局限,但已改变开发周期,企业多已应用。

新智元
开源动态7

AI办公斩杀线,一页文档多少钱

腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。

CourseAI
新闻资讯7

The Batch: 977 | AI 对速度的需求为何如此迫切

开发者如今需更关注AI速度。OpenAI和Cerebras的Ultrafast、Google的Gemini 3.7 Flash、Nvidia的Nemotron 3.5 Lightning都主打速度。速度在AI领域对应延迟和吞吐量,影响应用体验和范围。

DeeplearningAI
推荐文章8

Kernel Design Agent(KDA) 的B200 GPU Kernel 编程准则 Skill

文章围绕 Kernel Design Agent(KDA) 的 B200 GPU Kernel 编程展开,介绍目标平台、架构参数,阐述独有特性与编程要点,给出关键性能准则调整方向,详述 16 条准则及特殊 Kernel 类型优化策略和编写前检查清单。

GiantPandaLLM
开源动态8

14.9k Star!Firecrawl 开源的 PDF 智能分类器,200 份文档 0.47 秒搞定!

Firecrawl 开源 PDF 智能分类与文本提取库 pdf-inspector,已获超 1.4 万人标星。它能智能分类、感知提取、转 Markdown 及按需路由,性能炸裂,分类快,多项指标领先,还支持多平台。

开源星探
新闻资讯7

微软叫停Tokenmaxxing!预算卡死,超限自负

从今年7月起,微软为各业务部门设「AI Token预算目标」,将GPT - 5.6设为内部默认模型。此前Tokenmaxxing风靡硅谷,如今大厂纷纷收紧AI使用,微软是最后跟进者之一。

量子位
新闻资讯7

马斯克宣布解散xAI,把数据中心整租给了他讨厌的Anthropic

当地时间5月6日,马斯克宣布xAI并入SpaceX更名为SpaceXAI,还将Colossus 1数据中心租给曾被他称“邪恶”的Anthropic。此时距SpaceX IPO路演仅33天,xAI解散或助力提升估值。

DeepTech深科技