大模型技术」共找到 10450 篇相关文章

开源动态8

AI操作有了“紧急刹车”!通义&自动化所AI决策诊断模型,GUI智能体纠错正确率SOTA

阿里通义实验室与中科院自动化所推出GUI - Critic - R1模型,能在GUI智能体操作执行前诊断决策,避免错误。介绍了其动机、方法、数据集及实验,证明该模型在生成判断和提建议方面有效。

量子位
开源动态8

腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实

腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。

AIGC开放社区
开源动态8

加速200倍,单显卡1.8秒生成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁

清华、生数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。

AIGC开放社区
算法论文8

奖励模型也能Scaling!上海AI Lab突破强化学习短板,提出策略判别学习新范式

上海人工智能实验室提出策略判别学习(POLAR)新范式,解决奖励模型设计与训练瓶颈。POLAR可灵活适配多样需求,弥补传统奖励模型短板,契合强化微调框架,实验证明其性能和泛化性优越。

量子位
开源动态8

图像编辑太慢太粗糙?全新开源自回归模型实现精准秒级修改 | 智象未来

AI图像编辑中扩散模型有两难题,智象未来团队提出全新自回归图像编辑框架VAREdit,引入视觉自回归架构,提升编辑精准度与速度。模型和代码已开源,还提出SAR模块优化,在基准测试表现出色。

量子位
新闻资讯8

OpenAI发布ChatGPT世代首个开源模型gpt-oss,4060Ti都能跑得动。

8月6日晚,OpenAI发布ChatGPT世代首个开源模型GPT - oss,有120B和20B两款。模型原生支持4 - bit量化,性能损失小,低配置显卡也能运行。跑分表现不错,还介绍了使用途径,虽有不足但改变开源社区格局。

数字生命卡兹克
新闻资讯7

危险?OpenAI 模型行为负责人:人类很快会进入「AI意识」,当前最重要是控制人机关系的影响

OpenAI模型行为与政策负责人Joanne Jang发文指出,与其争论AI是否有意识,不如关注其对人类“情感福祉”的影响。文章探讨了OpenAI在人机关系上的处理,以及如何塑造模型行为,还提及未来计划。

AI寒武纪
推荐文章8

企业软件研发AI转型的坐标系:奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》

奇点智能研究院发布《AISMM 2026 AI原生软件研发成熟度模型白皮书》。当下模型发展快,但组织转型慢。白皮书构建5×5矩阵,助企业明确自身位置与路径,还剖析软件形态、工程变革等关键内容。

AI科技大本营
开源动态8

PyTorch博客翻译 Accelerating Generative AI Part III: Diffusion, Fast

这篇博客介绍用纯原生 PyTorch 技术将文本到图像的 diffusion 模型(特别是 Stable Diffusion XL)推理速度提升高达 3 倍的方法,讲解五种优化技术,还验证了方法在其他 diffusion 模型上的通用性和有效性。

GiantPandaLLM
算法论文8

清华刘洋团队论文:揭示为何 70B 的医疗模型,反而不如 8B 会问诊丨ILCR 2026

在医疗AI领域,模型静态评测与临床问诊能力存在断层。清华刘洋团队提出DOCTOR - R1,将临床问诊建模为POMDP,用强化学习训练。实验验证了其有效性,对医疗AI发展有深远启示。

AI科技评论