「生成模型进化」共找到 9126 篇相关文章
田渊栋离职Meta,最后一篇论文?
离职Meta后,田渊栋团队论文被NeurIPS 2025录用。研究提出「三门理论」,发现RLVR微调在小权重发力,不破坏模型结构,还绘制出RLVR训练动态的「参数层面全景图」。
具身智能能力狂飙,安全却严重滞后?首个安全可信EAI框架与路线图出炉!
具身人工智能发展迅速,但能力与安全出现“脱钩”。上海人工智能实验室和华东师范大学团队撰写论文,为“安全可信具身智能”建立理论框架与蓝图,提出成熟度模型、分析框架等。
Claude Code 开发者谈如何用 Claude Code 开发 Claude Code
Anthropic的Claude Code创建者Boris Cherny在访谈分享智能体编程未来看法,介绍用Claude Code开发它自身的方法,还谈及Claude Code发展、使用技巧及对编程工作未来变化的预测。
OpenAI放大招!核心API支持MCP,一夜改变智能体开发
今天凌晨,OpenAI全资收购io消息吸睛,还悄悄宣布核心API——Responses API支持MCP服务。这简化智能体开发,还能集中管理工具、保障安全。此外,Responses API的图像生成等工具也有更新,并引入新功能。
奥特曼亲自点名:他定义了OpenAI的技术路线,却几乎没人知道他是谁
2026年7月28日,Altman在播客推Alec Radford至台前,称其为领域重要却鲜为人知的研究者。他主导GPT、CLIP、Whisper等研发,为AI发展贡献大。2024年他离开OpenAI,此后发布Talkie,持续探索模型能力来源。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
DeepSeek-R2可能本月发布,使用华为AI芯片
Huaweicentral消息,搭载华为昇腾AI芯片的DeepSeek - R2可能8月15 - 30日发布,或媲美GPT - 5。它运行在昇腾910B芯片集群,参数规模达1.2万亿,将以低价提供API,冲击开源大模型市场。
5Y News | 欧拉万象完成数亿元融资,要做「养成系」家庭具身智能机器人
家庭具身智能企业欧拉万象近日完成数亿元融资,由招商局创投领投。创始人周顺波、联合创始人张靖履历亮眼。其走‘渐进式进化’路线,将推可养成机器人,获资本市场认可。
把屁声发给ChatGPT,它说这是艺术
有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。
DeepSeek深夜更新后自曝:我是V4(?!)
DeepSeek网页端深夜大更新,推出「快速模式」和「专家模式」,还有「视觉模型」开启灰度测试。虽官方未说明,但网友推测专家模式可能是V4或V4 Lite,完整版V4或许不远。