预训练框架」共找到 3486 篇相关文章

开源动态7

专访|两位华人主导创办,Jeff Dean参投,伯克利开源项目SkyPilot转型初创

前沿模型团队算力瓶颈从不足变为分散,开源AI算力调度项目SkyPilot应运而生。7月末,它从高校走出成为初创公司,完成2000万美元种子轮融资。其免费版与商业版各有侧重,切入AI编排赛道潜力大。

DeepTech深科技
算法论文8

刚刚,Anthropic新作:大模型意识被发现了

Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。

PaperAgent
新闻资讯8

软件 3.0 时代来临

OpenAI 联合创始人 Karpathy 在 AI Ascent 2026 大会提出软件正经历第三次范式转移。从 Software 1.0 到 3.0,人类参与编程方式不断变化,3.0 用自然语言编程,中间层应用被模型原生能力吞噬。

AGI Hunt
算法论文8

LangFlow: 挑战离散扩散,探索下一代语言模型新范式

UIUC Ge Liu团队发布《LangFlow: Continuous Flow Matching for Large Language Models》,回归连续扩散架构。研究指出连续扩散受挫非先天缺陷,经优化,LangFlow让连续扩散在标准基准追平离散扩散,为多模态统一架构打通底层路线。

机器之心
算法论文8

ACL 2026 | 别轻易给AI发「~」,它可能会删掉你的整个主目录

西安交通大学等校团队揭示大模型表情符号语义混淆安全漏洞,用自动化框架测试主流大模型,平均混淆率38.6%,多数混淆响应会“静默失败”,超半数达高危害级别。

机器之心
产品应用7

谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路

阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干。虽世界模型尚处早期,但应用场景广泛。

机器之心
新闻资讯8

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失

Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度零损失,解决了传统算法的压缩开销问题。

AGI Hunt
开源动态7

龙虾的应用商店挂牌了!北大开源MagicSkills,让Agent Skill可自由安装组合同步

北京大学Narwhal - Lab开源项目MagicSkills,把AI Agent所需技能统一管理,实现能力复用。它解决了技能管理分散、重复等问题,提供共享体系,让技能可安装、组合、同步和调用,适用于多Agent项目等。

量子位
算法论文8

CVPR 2026|清华联合美团推出3DThinker,首个用3D意象思考的工作

当前多模态大模型在空间理解任务表现弱,缺乏对几何信息提取能力。清华联合美团推出3DThinker,无需3D标注和外部工具,让模型内蕴‘想象’三维场景,在多基准上提升效果,且具备一定可解释性。

机器之心
开源动态8

智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析

智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本低,推动文档智能化处理升级。

AIGC开放社区