「超低延迟」共找到 3047 篇相关文章
堆了一仓库GPU,却生产不出专业智能?九章云极用AI工厂给出解答
企业接入通用大模型到业务系统,却发现它难以执行任务。九章云极在发布会上推出‘AI工厂’战略,通过训练工厂和Token工厂填平执行鸿沟,前者用强化学习造专业模型,后者让专业智能规模化流通。
Claude Code 推出安全审计插件,边写代码边抓漏洞
Claude Code上线官方安全插件security - guidance,能在写代码时自动识别并修复安全漏洞。它分三层防线,覆盖多种漏洞类型,还支持自定义安全策略,安装方便,但只是辅助工具。
AMD新论文颠覆认知:FP4训练不稳定,原因不是随机性不足
大模型训练成本高,降低训练精度可降成本。AMD联合宾州州立大学论文颠覆认知,揭示FP4训练不稳定源于结构性微缩放误差,非随机性不足,还在原生FP4硬件完成大模型预训练。
编程新王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10
Cursor推出全新AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。
Claude Design开源版本来了!支持超过 71 套最顶级的品牌设计系统,可以直接复刻,构建属于你的顶级网页!
Anthropic的Claude Design闭源,Open Design是其开源替代品。它支持超71套顶级品牌设计系统,可直接复刻构建网页,还支持多种coding agent,有完整提问机制,确保产出符合需求。
AI4S设计的新抗生素通过湿实验!双层思考+多目标优化,主动发现「代谢不稳」并加约束
SAGA是新AI,采用双层思考机制,能主动审视需求、优化目标函数。在抗生素、纳米抗体等5大领域湿实验中表现出色,结果获科学家肯定,相关代码已开源。
Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文
谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。
ICLR 2026|与上海AI实验室里约相见:北极星X星启交流会邀约全球AI英才
ICLR 2026 将于 4 月 23 日至 27 日在巴西里约热内卢召开,收到超 1.9 万篇有效投稿,录取率约 28%。同期上海 AI 实验室将举办交流会,邀全球 AI 英才,搭建学术与产业对话桥梁。
OpenClaw大考!上海AI Lab InternLM团队WildClawBench 60题,把「龙虾」AI打回原形
上海人工智能实验室InternLM团队推出WildClawBench,含60道高难度任务,在真实OpenClaw环境端到端评测AI Agent。评测涵盖多类别任务,已测14个模型,国产模型表现亮眼,项目开源可复现。
仅需一行代码AI智商飙升成本反降!Claude推出军师模式:最强模型opus只做幕后大脑
Anthropic在Claude平台实装军师策略,让Opus模型后台当军师,轻量级模型当执行者。仅改一行代码就能实现,成本低且能提升智商,已开启Beta测试,还给出使用步骤。