「高可用机制」共找到 2818 篇相关文章
原来Grok是36个小时极限卷出来的!xAI创始成员离职后放开说了
xAI前创始成员托比哥爆料,马斯克要求团队36小时内发布Grok。当时团队仅10人,面对半成品,高强度连轴转完成开发,使其走红。还提到马斯克硬核工作文化,虽压力大但成果显著。
阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了
阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。
了解下 FlashInfer SKILLS 写法
文章介绍 FlashInfer 的三个 SKILL 文件,涉及调试、性能测试、添加新 kernel 等开发场景。如通过装饰器做 CUDA 调试,提供两种计时方式做性能测试,还给出添加新 kernel 的 10 步流程及最终文件清单,实用价值高。
首钢园“产业跃升俱乐部”首秀:从WANOS全景声到波萝元宇宙
首钢园“产业跃升俱乐部”首期轮值活动“从WANOS全景声到波萝元宇宙”成功举办,标志开启月度轮值新机制。活动汇聚各方精英,探索创新驱动产业跃升路径,展示波萝元宇宙成果,还围绕技术与投资议题讨论。
刚刚,微软全新一代自研AI芯片Maia 200问世
微软原定于 2025 年发布的下一代 AI 芯片 Maia 200 问世。它基于台积电 3 纳米工艺,性能强、能效高,是异构 AI 基础设施重要部分,将为多个大模型提供支持,已部署在美国中部数据中心区域。
安全垂类小模型效果能超过大模型?看看以色列Novee的效果
跟踪AI渗透测试等开源应用发现,通用大模型成本高、功能受限。以色列Novee融资5150万美元并发布4B小模型,测试效果超Claude 4 Sonnet。其靠两阶段训练和浏览器反馈提升能力,有投资说明有价值。
中国科技企业出海的6条最新趋势!
作者在美国拉斯维加斯CES展及硅谷调研后,总结了AI和中国科技企业出海的6条趋势,包括Token消耗激增使自研成大势,AI提升消费电子产品溢价,软硬件边界模糊等。
腾讯LLM团队:对下一个 Token 预测的深入剖析,多样性 or 精准度?
最新研究证实RL能增强LLM推理,但成效受限预训练token分布。腾讯LLM部把交叉熵重写成单步策略梯度,用超参压熵,为RL打造‘低熵高信号’起点,经实验验证低熵模型优势明显。
168小时AI狂写300万行代码造出浏览器!Cursor公开数百个智能体自主协作方案
Cursor创始人公布实验结果,让数百个AI智能体跑一周,从零造出可用Web浏览器,产出超300万行代码,项目源码已公开。此次实验靠GPT - 5.2 - Codex,还设计了智能体协作架构,引发业界讨论。
工业级文本转SQL新思路:成本暴降、超3000列超大数据库依然稳健
华中科大与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超大规模数据库模式的高精准链接与筛选,以低Token消耗刷新两大榜单纪录。