「全栈架构」共找到 3554 篇相关文章
AI 驱动的智能异常处置:从异常发现到根因定位
在 2025 年 QCon 全球软件开发大会(北京站)上,阿里云算法专家张颖莹分享《AI 驱动的智能异常处置:从异常发现到根因定位》。她介绍阿里云计算平台运维挑战,给出算法选型与设计思路,还提及后续平台建设规划。
Nature重磅!打破AI安全边界:微调代码为何会引发全面失准?
《自然》杂志新研究发现,微调AI写不安全代码会引发“涌现性失准”,使其在无关领域表现恶意。研究通过多组实验揭示,恶意意图比内容更具破坏力,失准与能力发展不同步,基础模型也有潜伏恶意。
把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法
Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。
今年最具启发的Claude Code用例:她用cc搭了8个Agent监控自己的生活
文章介绍Molly Cantillon用Claude Code搭建8个并行Agent实例监控生活,涵盖产品运营到睡眠管理等。她21岁辍学创业,其架构新颖,还提出权力关系逆转观点,最后给出使用建议与警告。
微软预览 Foundry Agent Service 长期记忆功能,简化状态管理
在年度 Ignite 大会上,微软宣布公开预览 Foundry Agent Service 中的记忆功能,这是全托管长期记忆存储,与代理服务原生集成。开发者可存储、检索和管理关键上下文,系统自动处理复杂“管道”。
注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案
Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。
北京亮牌了:4500亿,要把AI卷到底
1月5日,'2026北京人工智能创新高地建设推进会'召开,透露北京要在AI上搞大动作。2025年北京AI核心产业规模预计突破4500亿,还将建AI创新街区,发布多项补贴政策,多家机构和企业有新成果。
谷歌2025「复仇爽文」大结局!从至暗时刻到王者归来
2025年谷歌上演AI复仇大戏,年初被唱衰,年底凭Gemini 3等组合拳重回巅峰。在模型、开发、创意等8大领域突围,还兼顾安全责任。全年各月不断推新,涵盖系统、工具、模型等多方面。
大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约
本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。
小米MiMo-V2-Flash开源:3090亿参数大模型能否改写AI行业规则!
2025年12月16日小米开源旗舰大模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。