高可用机制」共找到 2818 篇相关文章

算法论文7

The Batch: 939 |在推理阶段学习长上下文

大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。

DeeplearningAI
开源动态8

AI 行业悄悄统一了一件事:Agent Skills 开放标准全解析

Agent Skills 是一套开放标准格式,超 30 家主流 AI 开发工具已采纳。它结构简洁,有精妙的三层加载机制,解决了 AI Agent 上下文窗口问题。与 MCP 解决不同层面问题,生态正快速成型。

AI Reading Hub
开源动态8

中国开源首超美国:Hugging Face发布全球AI开源现状报告

Hugging Face发布报告显示,2025年开源AI生态繁荣,用户参与度。中国首次超越美国,成月下载量最大的模型来源国。各国政府推动主权AI,硬件支持更多元,机器人和科学领域发展迅速。

AIGC开放社区
算法论文8

北大团队提出 SHINE:将任意文本转化为大模型 LoRA,仅需一次前向传播!

北大团队提出全新超网络架构 SHINE,仅需一次前向传播就能将任意文本转化为大模型 LoRA 参数,支持多轮对话。该方法实用潜力大、架构创新效,训练流程成熟,推理快速,为大模型持续学习提供新思路。

机器之心
算法论文8

没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~

AI写代码能力提升,但打分方法僵化且成本。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。

PaperAgent
新闻资讯7

阿里财报暴跌7%,华尔街却集体喊买入——这里有个逻辑差

3月19日阿里发布2026财年Q3财报,股价跌7.3%。散户看到净利润暴跌、现金流为负,华尔街关注阿里云增长与AI潜力。文章分析财报,探讨钱去向、风险及投资决策。

AI Reading Hub
新闻资讯8

谷歌AGI底座降临!首个原生全模态嵌入模型上线,已实现全模态SOTA

谷歌发布首个原生全模态 Embedding 模型 Gemini Embedding 2,将文本、图、音视频及 PDF 融于统一向量空间,实现跨模态检索,降低架构成本,赋予 AI 连贯「记忆」,是重塑 AI 基建的里程碑。

新智元
算法论文8

分享2篇OpenClaw最新Skill论文~

OpenClaw作为最大开源Agent框架,其Skill生态安全受关注。分享两篇论文,《Clawdrain》揭示Token耗尽攻击,《SkillFortify》提出形式化防御框架,从攻防维度揭示OpenClaw深层安全风险。

PaperAgent
新闻资讯7

鹅厂带大家“养虾”,昨天刚装、今天就裸奔!田渊栋:OpenClaw就像拿着所有秘密的笨小孩出门办事

OpenClaw 掀起安装热潮,SetupClaw 代装收费,小米推手机版。腾讯云线下帮装机,却出现安全暴露和扣费问题,且 OpenClaw 安全事故频发,官方收紧权限但仍有风险,中美态度不同。

InfoQ
开源动态8

FlashAttention-4正式发布:算法流水线大改,矩阵乘法级速度

深度学习领域底层优化技术FlashAttention更新至4版本。其核心作者称在Blackwell GPU上,注意力机制执行速度接近矩阵乘法。新算法克服瓶颈,在B200上性能提升,还获Pytorch官方支持。

机器之心