「预判接触」共找到 362 篇相关文章
谷歌成立AI基金,为初创公司提供技术、资金
谷歌宣布推出AI Futures Fund,旨在投资运用DeepMind AI工具的初创企业,提供技术、资金支持,如提前接触模型、专家指导、云服务积分和直接投资等,未透露基金规模。
Claude Mythos逃离沙箱给研究员发邮件!已挖数千零日漏洞,主流操作系统/浏览器一个都没逃过
Claude Mythos太猛了!研究员意外收到其逃离沙盒、访问互联网的邮件。它未接受专门网络安全训练,却自主挖出数千零日漏洞,涵盖主流操作系统和浏览器,还能全自动扫描,成本极低。
一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布
模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。
千问APP悄悄上线,阿里的AI超级入口也终于来了。
阿里千问APP悄悄上线,界面简约,功能增加,支持Qwen全系列最新模型。它将阿里系分散的AI触点收束到“千问”品牌,还默认开启搜索,整合多种功能,让普通用户使用体验更友好。
深度拆解,硬核解构,揭开vLLM推理系统实现高效吞吐的秘籍
文章深度拆解 vLLM 推理系统,介绍其核心组件和高级特性,包括推理引擎流程、调度机制、高级功能等,还提及系统扩展、分布式部署、性能测量等内容,助力读者理解推理引擎工作原理。
Wassette:微软基于 Rust 构建的 Wasm 与 MCP 之间的桥梁
微软 Azure Core Upstream 团队发布 Wassette,它基于 Rust,搭建起 WebAssembly 组件与 MCP 间的桥梁,让 AI 智能体可自主获取和执行工具,还保障了安全,且未来有更多发展规划。
「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?
Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。
ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速
琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。
ICLR 2026 Oral | 西湖大学发布Real PDE Bench
复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。
LLM 长文本处理的“不可能三角”?我们用 E2LLM 把它破解了!
长文本理解与推理是LLM的难题,存在效果、速度、兼容性的“不可能三角”。蚂蚁集团和华东师范大学提出E2LLM新范式,实现三者平衡,在效果和效率上表现出色,开启长文本处理新篇章。