「开放架构」共找到 2368 篇相关文章
仅2G内存可跑,刚刚,谷歌开源Gemma 3n,端侧原生多模态!
谷歌全面发布Gemma 3n,将多模态AI功能带入边缘设备并在Hugging Face开源。它原生支持多模态输入输出,针对设备端优化,内存占用低,采用开创性架构,Gemma系列质量也不断突破。
Agent全自动搭建代码运行环境,实时更新解决评测过拟合/数据污染问题|微软
长期以来主流代码修复评测基准SWE - bench问题多,制约AI模型能力展现。微软发布SWE - bench - Live,引入新Issue,实现环境自动化构建与更新,打破传统局限,还揭示传统基准过拟合问题。
刚刚,谷歌AI路线图曝光:竟要抛弃注意力机制?Transformer有致命缺陷!
谷歌未来AI路线图曝光,Gemini全模态是重点,模型向智能体转变,推理能力将扩展。谷歌还需突破现有注意力机制限制实现无限上下文。此外,文中盘点了OpenAI、DeepSeek等大厂AI年中表现。
仅凭一篇博客,他成功入职OpenAI!核心技术或用于GPT-5训练
Keller Jordan设计Muon优化器并公开研究进展,引OpenAI和xAI关注,最终加入OpenAI。Muon性能卓越,或用于GPT - 5训练,其故事暗示传统论文模式在AI领域或已落伍。
Transformer八周年!Attention Is All You Need被引破18万封神
Transformer已满8岁,其开创性论文《Attention Is All You Need》被引超18万次,掀起生成式AI革命。它催生诸多前沿产品,让人类跨入生成式AI时代,虽起初未受关注,但如今影响深远,谷歌态度也在改变。
WWDC 2025 让大家“失望”了?no!苹果在下一盘AI大棋
苹果WWDC 2025未推出预期AI应用矩阵,股价下跌引失望。但实则是深思熟虑之举,它开放端侧模型及工具,让开发者创新,规避风险,待AI成熟凭借优势“后发先至”。
浅析 rust 大明星 Tokio
本文剖析热门Rust库Tokio,介绍其优势与适用场景,从Rust异步着手,分析架构、调度生命周期,还对比Nginx,探讨绑核方法与未来方向,如支持IO Uring、扩展协议栈等。
单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2
智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡能处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。
万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2
长视频理解是多模态大模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。
两岁的Llama,最初的14位作者已跑了11个!Mistral成最大赢家
Meta 开源 Llama 模型改变大模型格局,但短短两年,14 位初创作者 11 人离职。Mistral 受益最大,由两位核心架构师创立,其模型与 Meta 竞争。Meta 面临留才挑战,领先优势消退。