「GLM-4.1V-9B-Thinking」共找到 3111 篇相关文章
Karpathy 最新演讲精华:软件3.0时代,每个人都是程序员
Andrej Karpathy 在 YC 旧金山创业大会演讲,介绍软件从 1.0 到 3.0 的演变,指出软件 3.0 由 LLMs 驱动,自然语言提示成编程方式。还阐述 LLMs 特性、机遇与挑战,强调为 Agent 构建软件等内容。
全球顶尖AI做物理,被人类按地摩擦?不懂推理大翻车,本科生碾压
港大等机构用3000道物理题测试顶尖大模型,如GPT - 4o、Claude 3.7 Sonnet等,结果模型准确率远低于人类专家。研究推出PHYX基准测试,揭示模型依赖知识、公式和模式匹配,缺乏真正物理理解。
Veo 3全网实测惊艳所有人!DeepMind CTO:规模是AGI全部吗?
谷歌推出视频生成模型Veo 3,一句提示词就能打造电影质感短片,还能音画同步,引发网友惊叹。DeepMind CTO在访谈中表示,规模非AGI唯一要素,还提及Deep Think模式及Veo 3进展等。
风投的钱,开始由AI科学家重新分配
近年新型AI公司NeoLab兴起,获风投后开始资助外部科研。如Thinking Machines Lab、Periodic Labs推出资助项目。NeoLab先定研究问题再选团队,决策快,虽有积极一面,但也可能使少数人影响研究走向。
哈佛《Science》研究:大模型已碾压人类医生!
哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。
如果你还在犹豫要不要尝试 OpenClaw,试试这个 App 一键部署方案
作者推荐 OpenClaw 这款开源产品,它像钢铁侠的 AI 助手贾维斯,可与通讯协同软件协作。还介绍用百度智能云 1 分钱部署 OpenClaw,阐述其配置、应用及价值,称 AI 会成基础设施。
梳理SGLang中DP Attention及其Padding问题
作者梳理SGLang中DP Attention及其Padding问题。介绍DP Attention背景、流程,指出padding分max和sum模式,旧版sum padding浪费计算、影响cuda graph使用,v0.4.10后有优化,max padding仍待完善。
一个“蠢问题”改写模型规则!Anthropic联创亲曝:瞄准Claude 5开发爆款应用,最强模型的价值会让人忽略成本负担
Anthropic联合创始人Jared Kaplan在YC分享Scaling Law对大模型发展的影响及Claude模型意义。他指出Scaling Law源于问“蠢问题”,是推动AI进步核心动力,还给出产品构建建议,介绍Claude 4优化。
10岁孩子都能训机器人!对话松应科技创始人:做物理AI界的“安卓”挑战英伟达,正将其开源开放
松应科技创始人聂凯旋表示团队对标英伟达,四年达其主流能力,产品落地多家企业。松应发布 ORCA Lab 1.0 开发者版,降低具身智能研发门槛。其采用开放生态,构建数据策略,目标培养物理 AI 人才,推进自主创新。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。