「后Transformer架构」共找到 3687 篇相关文章
「斯坦福AI小镇」创业即获投1亿美元!李飞飞卡帕西都投了
2023年斯坦福团队构建AI小镇Smallville,其智能体可自主生活。如今团队创业成立Simile,获1亿美元融资,李飞飞、卡帕西跟投。它将升级架构构建大规模模拟平台,用于人类决策的风险预测。
十三年布局,一朝反超!谷歌AI崛起的真实故事
2025年谷歌多款AI成果表现亮眼,如Nano Banana登顶、Gemini App下载量第一、Gemini 3超ChatGPT。这场逆袭始于2012年太浩湖竞拍,之后谷歌收购DeepMind、发明Transformer、自研TPU芯片,虽历经波折,终在2025年反超。
马斯克说到做到:开源X平台核心推荐算法
X(原Twitter)开源内容推荐Feed on X召回、精排推理、策略代码,模型参数配置较小,应是简化Demo版。召回用双塔模型,精排用双层Transformer,还介绍了系统架构、模型细节等。
阿里发布首个「音视频实时交互」模型,实现数字人实时视频聊天
阿里发布原生流媒体端到端模型Wan - Streamer v0.1,能实时聆听、观看、思考、说话和响应视频。它在单个Transformer内完成感知等操作,延迟低,具备端到端多模态统一、低延迟等特点。
ICML'25 | 告别手动SFT!一句话得到你的专属大模型LoRA
传统微调方法开销大、部署难,Text-to-LoRA (T2L) 框架应运而生。它基于自然语言指令对 Transformer 模型即时适配,有三种架构变体,采用两种训练方法,实验显示其在多维度表现有效。
图像分层生成:新加坡国立大学和Lowart AI实现了图像可编辑的PSD文件输出
新加坡国立大学和Lowart AI发布OmniPSD,利用Diffusion Transformer架构解决分层图像生成与拆解难题,实现可编辑PSD文件输出。它能通过文本生成分层PSD文件,也能拆解单张平面图像,解决AI生成图像难编辑痛点。
腾讯重磅开源:端到端文档转换VLM,中英文错误率双料最佳!
腾讯开源端到端文档转换视觉模型POINTS - Reader,可将文档图片转结构化文本。它基于POINTS1.5架构,支持中英文。在OmniDocBench基准上,中英文错误率暂列最佳,具零后处理简单等亮点。
机器人长出800个心眼?阿里达摩院开源具身新大脑,硅谷又坐不住了
2026年具身智能竞争激烈,阿里达摩院开源RynnBrain“具身大脑”。它采用分层架构,在16项评测中超越前沿模型。还介绍了核心技术、训练策略等,且全系列模型、评测基准和代码均开源。
AI Agent已过时?OpenAI亮出王牌Deep Research!
浙江大学一篇综述论文《A Comprehensive Survey of Deep Research》系统性梳理了Deep Research赛道。它是一类AI系统,其背后的Agent范式可迁移到各场景,文章介绍了其技术、架构、应用及面临的挑战与未来方向。
360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题
360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。