非Transformer架构」共找到 2528 篇相关文章

产品应用8

MiniMax都在用!5500PB幕后功臣首次亮相,国产黑马祭出杀招

AI浪潮中,数据流不动致GPU算力空转,XSKY星辰天合举办AIMesh产品战略发布会破局。AIMesh含三网,分别解决IO墙、重力墙、内存墙问题,且开放解耦,获多方认可。

新智元
开源动态7

最近涨疯了,用这个开源项目打造卫星追踪副业!

最近A股市场卫星概念大热,太空产业受关注。Github上有开源卫星可视化平台`keeptrack`,工程师能轻松用它追踪卫星轨迹,程序员还能二次开发。它功能多、性能好,免费开源。

开源先锋
新闻资讯8

GPT-5.2连肝7天,300万行代码造出Chrome级浏览器

Cursor的CEO让GPT - 5.2连续运行一周,产出300万行代码,从零构建Chrome级浏览器。还介绍不同模型长任务表现、多智能体协作架构,指出这将颠覆软件开发经济学。

新智元
新闻资讯7

Anthropic 为什么推出 Skills?它会革谁的命!

近期Claude Code出圈,开发者基于其构建应用。Anthropic 作为先驱,在 MCP 后推出 Skills,旨在解决现有技术架构痛点,它是标准化 SOP,有分层设计优势,还推荐了 skill0.atypica.ai 平台。

AI工程化
新闻资讯7

继宇树后,唯一获得三家大厂押注的自变量:具身模型不是把DeepSeek塞进机器人

2026 开年,自变量机器人获字节、红杉 10 亿融资。自变量认为具身智能不是 AI 模型应用,需“生于物理世界、用于物理世界”的基础模型,其有自研成果,还开源模型组织黑客松。

机器之心
算法论文8

DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻

据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。

AIGC开放社区
算法论文8

语义分割别无脑用Argmax!港中文新算法:三行代码,推理速度提升10倍

香港中文大学提出全新算法框架RankSEG提升语义分割性能。传统方法用threshold或argmax生成掩码并最优,RankSEG无需重训模型,加三行代码就能提高分割指标,还开源了工具包,其改进版RankSEG - RMA推理速度大幅提升。

新智元
算法论文8

Nature Computational Science | 香港城市大学韦业等:复杂系统深度主动优化

本文通过集成深度神经网络和树探索能力,提出神经网络代理模型引导树探索的主动优化方法。该方法在超2000维数值优化问题中找到全局最优,在多领域表现优于现有方法,为小样本、高维优化难题提供通用技术。

力学与人工智能
推荐文章7

4000 Star,Vibe Coding终级指南:胶水编程

Vibe Coding由karpathy提出,本文分享其终极指南。介绍了胶水编程、方法论精要、工具资源、编码模型性能分级参考等内容,还给出架构与工作流程,建议选第一梯队模型处理复杂任务。

PaperAgent
算法论文8

VGGT4D:无需训练,挖掘3D基础模型潜力,实现4D动态场景重建

香港科技大学(广州)与地平线研究团队提出 VGGT4D,无需训练,通过挖掘 Visual Geometry Transformer 注意力层运动线索,在动态物体分割等任务表现优异,为 4D 重建提供新思路。

机器之心