新架构」共找到 4965 篇相关文章

6

九月站比赛结果出炉,第一名网站上线当月拿下217K的PV。

社群里的明星朋友Clara通过参加站比赛,副业收入已超工资,即将全职独立开发。9月比赛结果显示,参赛网站类型丰富,第一名网站上线首月就获得217K的PV。

哥飞
新闻资讯7

100亿美元押注AI:红杉换帅后,寻找“白天鹅”

2026年8月,红杉资本募得约100亿美元。掌舵人林君睿和帕特接受专访,称当下是“白天鹅”市场。此前红杉经历领导层更替,团队调整投资决策,还补仓Anthropic,布局AI多环节。

DeepTech深科技
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化突破

当前VLA模型常依赖视觉线索而非语言指令,导致场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元
算法论文8

比Transformer更强的架构来了?浙大作Translution,一统卷积和自注意力

随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现自注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为一代神经网络发展开辟方向。

新智元
算法论文8

CVPR 2025 Highlight | 提升自回归模型样例学习能力,Few-shot图像编辑范式开源

当前图像编辑模型在处理概念时泛化能力不足,为解决此难题,Meta等研究者提出自回归模型InstaManip,创性提出分组自注意力机制和关系正则化策略,在few - shot图像编辑任务上取得优异效果。

机器之心
推荐文章8

万亿AI存储鸿沟如何填平?

文章指出AI存储迎来爆发期,一代分布式存储成主流。分析存力需求变化、传统存储架构问题,介绍Universal Storage架构优势,还提及对标Vast Data的公司画像,认为一代存储软件赛道值得关注。

芯师爷
开源动态8

文本已死,视觉当立!Karpathy狂赞DeepSeek模型,终结分词器时代

DeepSeek成果DeepSeek - OCR以像素处理文本,压缩率小于1/10,基准测试领跑,开源一夜获4.4k星。Karpathy力挺,认为应赶走分词器,展望视觉成通用输入前景,马斯克有更科幻猜想。

新智元
开源动态8

腾讯开源智能体框架:不用训练无需充值,用开源模型实现SOTA Agent

智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。

量子位
算法论文7

ICCV2025 | 多视图生成范式-利用自回归模型探索多视图生成

本文介绍自回归生成多视图图像方法 MVAR,能从先前视图提取引导信息增强一致性,拉近与基于扩散方法的图像质量差距。解决了多模态条件控制和数据有限问题,展示出强指令遵从与多视角一致性。

机器之心
算法论文8

把VLM塞进隐式世界模型,小鹏机器人框架让机器人长出物理直觉

机器人大脑架构中VLM和VAM路线各有短板,香港大学、小鹏机器人等团队提出DIAL框架,让VLM在原生特征空间做隐式世界建模,解耦认知决策与底层执行,在机器人部署中表现优异。

量子位