生成式预训练」共找到 4017 篇相关文章

开源动态8

去掉 VAE 之后,商汤用 8B 参数重新定义了开源生图的上限

商汤SenseNova U1开源后引发开发者社区关注,它基于NEO - unify架构,摒弃VAE,实现多模态理解与生成原生统一。在多项基准测试中表现出色,还针对企业办公场景优化,成为生产级任务新选择。

AI科技评论
算法论文8

Kimi新架构让马斯克叹服!17岁高中生作者一战成名

17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。

量子位
算法论文7

新研究重新评估 AGENTS.md 文件在 AI 编码中的价值

苏黎世联邦理工学院新论文指出,`AGENTS.md` 文件可能常阻碍 AI 编码智能体。研究构建 AGENTbench 数据集测试,发现 LLM 生成文件降低性能,人类编写文件有边际收益但也增加成本,开发人员对此研究看法不一。

InfoQ
推荐文章7

GUI 将死,CLI 才是一切

文章指出 GUI 时代将尽,CLI 正赢下一个十年,其用户将是 Agent。介绍了 CLI - Anything 项目,它能为软件生成 CLI 接口,让 Agent 用命令行操控软件,还探讨了 Agent 命令执行权限等问题。

AGI Hunt
产品应用8

能导出 PSD 的 AI 设计工具,出现了

国内 Seede AI 团队发布海外新产品,无需写咒语,填文案信息就能让 AI 搞定排版等。它生成可编辑源文件,适合有内容但不会设计的人,还支持多格式导出,不过不擅长创意生图。

AGI Hunt
算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
算法论文8

无需奖励函数!我们意外构建了自我进化的AI系统

牛津大学发现LLM可通过“部署 - 验证 - 再训练”循环自我进化,绕开人工奖励函数设计瓶颈。在三个经典规划领域实验效果惊人,还在理论上证明其与强化学习的数学等价关系,有优势也有隐患。

AI工程化
新闻资讯8

现场围观腾讯广告算法大赛,我都想入职了

腾讯广告算法大赛冠军可得200万奖金,赛题是「全模态生成式推荐」,涉及多AI方法,贴近真实业务且挑战多。比赛持续四月多,氛围友好。腾讯借此揽才,也为学生提供进大厂通道。

量子位
产品应用8

1分钟跑出数百预测!WeatherNext 2把短时预报带入小时级

谷歌DeepMind发布WeatherNext 2,能1分钟从同一初始场生成上百种未来,分辨率达1小时级,超上一代。它已接入Search等,重写天气预报逻辑,让预测从确定变多可能,还将改变气象体系。

新智元
开源动态8

LeCun预言成真!790年长视频,炼出最强开源「世界模型」

2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。

新智元