自回归架构」共找到 2880 篇相关文章

产品应用8

全球首个AI原生社交平台「Teamily AI」硅谷亮相,开启「人机共生」社交新元年

2026 年伊始,业界探索 AI 与人类真实交互。初创公司 Teamily AI 推出全球首个 AI 原生即时通讯应用,构建人类与 AI 共生社交网络,主打四大场景全域伴随,有三层架构技术护城河。

机器之心
新闻资讯7

继宇树后,唯一获得三家大厂押注的变量:具身模型不是把DeepSeek塞进机器人

2026 开年,变量机器人获字节、红杉 10 亿融资。变量认为具身智能不是 AI 模型应用,需“生于物理世界、用于物理世界”的基础模型,其有研成果,还开源模型组织黑客松。

机器之心
新闻资讯7

扎克伯格急了!Meta内部文件曝光:宁用竞品,也要废掉祖传系统

Meta的「超级智能实验室」发起内部革命,加速AI开发。扎克伯格豪赌AI,投巨资重组团队、吸引人才。内部文件显示,Meta强制员工用AI,还让员工弃研系统,用Vercel等平台。

新智元
新闻资讯7

英伟达斥资50亿美元入股英特尔

18日,英伟达与英特尔宣布深度合作,联合开发产品。英伟达将斥资50亿美元入股英特尔,双方以NVLink技术连接架构,合作聚焦数据中心和个人计算领域,旨在提升运行效率,填补产品空白。

芯师爷
新闻资讯7

AI行业的底牌已经亮完了,模型能力趋同后,拼什么?

Databricks MVP Adi Polak分析AI人才需求,指出能搭建评估管道等的工程师是硬通货。前沿模型架构趋同,行业从技术竞赛转向生态战争,比拼产品和用户理解能力,还为转型工程师给出建议。

AI工程化
开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
新闻资讯8

Claude Code出逃的主创又回来了!Anthropic:过去俩月我收入暴涨5.5倍,别走

Claude Code两位主创跳槽Cursor两周后回归Anthropic。Anthropic正洽谈新一轮融资,估值目标1000亿美元。其赚钱能力强,Claude Code表现亮眼,还将推分析仪表盘,Cursor收入增长也惠及它。

量子位
算法论文8

首个全面梳理语音大模型发展脉络的权威综述,入选ACL 2025主会

香港中文大学团队语音语言模型综述论文《Recent Advances in Speech Language Models: A Survey》被 ACL 2025 主会议接收,这是该领域首个全面系统综述,指明语音 AI 未来方向,还剖析技术架构、训练策略等。

机器之心
算法论文8

Speech LLM 的下一个突破口:你的语音大模型可以是个「带韵律的文本模型」

语音大模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文大学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。

机器之心
开源动态8

DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude

DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。

AIGC开放社区