「模型发布」共找到 9012 篇相关文章
Dario访谈首曝:Mythos被称为「超级武器」
Bloomberg主持人与Anthropic CEO Dario Amodei进行69分钟访谈。谈及Mythos模型强大危险不敢发布,还探讨AI递归自改进、文明崩塌概率、白领工作消失等问题,Dario坦率面对技术矛盾。
Claude Opus 4.5来了:谷歌把Anthropic逼到了墙角
上周谷歌发布Gemini 3 Pro表现惊艳,今日Anthropic推出Claude Opus 4.5应对。其编程能力强,SWE - bench Verified首超80%,且降价66%。还推出产品更新,开发者可按需选模型。
奥特曼亲自点名:他定义了OpenAI的技术路线,却几乎没人知道他是谁
2026年7月28日,Altman在播客推Alec Radford至台前,称其为领域重要却鲜为人知的研究者。他主导GPT、CLIP、Whisper等研发,为AI发展贡献大。2024年他离开OpenAI,此后发布Talkie,持续探索模型能力来源。
训练数据枯竭怎么办?首篇「数据价值密度」综述理清思路
上海交通大学与上海人工智能实验室团队发布首篇「数据价值密度」综述。提出“数据价值密度”概念并定义,建立分类框架梳理现有工作,还指出该领域面临的挑战,为大模型训练提供指南。
首个长程Doc2Repo训练集!代码Agent不止修bug,开始造仓库
中国人民大学高瓴人工智能学院发布DeNovoSWE数据集,专注长程软件工程任务。它通过特定机制构造高质量数据,为代码智能体长程能力训练提供支持,实验显示能显著提升模型仓库生成能力。
8000行Python+Rust手搓ChatGPT,日收14.5k星!Karpathy:Agent只会帮倒忙
特斯拉前AI总监Andrej Karpathy发布开源项目nanochat,可搭建简易版ChatGPT复现模型。约8000行代码,成本低,功能多。卡帕西称手写代码,用Agent效果差,项目受网友热赞。
Sand.ai重磅更新MagiAttention,正在定义分布式Attention性能新标杆
2025年4月,Sand.ai开源MagiAttention v1.0.0。如今发布v1.1.0,适配Blackwell新架构,构建原生Group Collective原语,经系统级协同优化,在多模型训练中得到实证,展现卓越性能。
Google I/O 2026 | 开发者主题演讲精华集锦
在今年 Google I/O 大会上,谷歌发布 Gemini 3.5 系列模型,升级 '智能体优先' 开发平台 Antigravity,展示新工具和技能,助力开发者构建应用,还介绍了多项新技术及功能,另有招募活动。
比NanoBanana更擅长中文和细节控制!兔展&北大Uniworld V2刷新SOTA
兔展智能与北京大学的UniWorld团队推出图像编辑模型UniWorld - V2,它提出UniWorld - R1框架,在权威测试中超越顶尖闭源模型。该框架通用性强,能提升其他基础模型性能,相关论文、代码和模型已开源。
刚刚,Anthropic王炸Claude泄露!全面碾压Opus 4.6引爆全网
因「人为配置」错误,Anthropic最强模型Claude Mythos细节泄露。它编程、推理能力超Claude Opus 4.6,还具备网络攻防能力,但也带来安全风险,Anthropic因担心被黑客利用暂未发布。