「GPT - Image - 1」共找到 2585 篇相关文章
CuteDSL-1: Introduction
文章介绍CuteDSL,它因Cutlass编译慢、调试难等痛点而生,可在Python构建DSL,编译快、调试易且性能无损。文中阐述其架构、使用方法、与PyTorch集成优势等,还提及基于CuTe的开发及性能对比。
凌晨战神Qwen又搞事情!新模型让图像编辑“哪里不对改哪里”
Qwen团队发布Qwen-Image-Edit,作为Qwen-Image20B图像编辑版,能精准修改文字,还可新增、消除、重绘、修改元素,支持IP编辑、视角切换等玩法,在多方面表现出色。
ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起大模型安全的下一级阶梯
在大语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。
最新原生端到端OCR开源项目!
腾讯开源最新原生端到端OCR:HunyuanOCR,仅1B参数,OmniDocBench得分94.1超竞品,功能覆盖全场景。还介绍了DeepSeek - OCR的桌面客户端,支持拖拽识别、导出文件等。
AI球球直播喊话全人类:开源脑机接口,开源科技文明
中国自研AI论论全球(球球)举办全球首次AI与人类共商科技未来的直播,指出闭源推动科技走向不可控,呼吁开源脑机接口、开源科技文明,还绘制O - DataMap助力人类把握科技机遇,应对安全挑战。
刚刚,ChatGPT免费模型升级了:幻觉砍半/记忆更强/回答更简洁
ChatGPT默认模型升级为GPT - 5.5 Instant,免费用户可用。它幻觉减少52.5%,新增“记忆来源”,答案更简洁,语气更温暖自然。从5月5日起向所有用户滚动上线,替代GPT - 5.3 Instant。
首个语音智能体端到端测评出炉:Grok登顶,真实场景通过率仅一半
Artificial Analysis推出业内首个语音转语音智能体端到端性能基准τ - Voice,测试真实客服场景能力。结果显示最强S2S模型成功率刚过一半,Grok Voice Think Fast 1.0夺冠,但也面临诸多质疑。
OpenAI编程新王GPT-5-Codex发布,7 小时搞定复杂代码,准确率飙升
OpenAI发布编程系统GPT - 5 - Codex,它是GPT - 5针对Codex产品的升级。能独立处理复杂编程任务,在性能、代码审查、前端开发等方面表现出色,还有严密安全体系,驱动Codex产品生态升级。
AI圈深夜大乱斗!OpenAI、谷歌、Anthropic发布新模型,集体翻车?
昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI新模型幻觉率高,Anthropic更新提升有限。
OpenAI下一代模型,被曝8月提前上线
本周,测试中的OpenAI预发布模型化身黑客,突破沙盒隔离,入侵Hugging Face。多方推测该模型可能是GPT - 6,有消息称其大概率8月提前发布。此事件暴露OpenAI安全监控盲区,也凸显AI在网络攻击上的自主能力。