「视觉设计」共找到 1881 篇相关文章
突然变强!速度翻4倍,GPT Pro惊现「神级」操作,网友怀疑GPT-5.5已就位
OpenAI悄悄完成GPT Pro模型升级,其速度提升、视觉理解能力增强。同时,代号「Spud」的GPT - 5.5已完成预训练,发布在即,AI竞争将更激烈。
Kimi K2基于DeepSeek V3构建
从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。
跨会话不再「失忆」:openJiuwen社区开源 AutoGenetic Memory,让Agent记忆自主生长
华为openJiuwen社区开源AutoGenetic Memory,让Agent记忆自主生长。它有分层记忆体系、Auto Dreaming等设计,能提升记忆准确率,降低Token消耗,让记忆从被动存储变为可治理、共享和自我演化的核心资产。
澳洲大神用ChatGPT手搓疫苗抢命,救活癌症晚期爱犬!OpenAI总裁爆赞
澳洲AI大牛Paul Conyngham无生物学背景,用ChatGPT+AlphaFold为患癌爱犬设计全球首支定制mRNA疫苗,数周肿瘤缩小50%,引发全网关注,OpenAI总裁等盛赞,或推动人类癌症治疗。
ImageNet分数越高,生成反而越糊?iREPA给出解释
Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。
Qwen2.5VL新玩法,看电影讲故事
本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。
AI Coding 流畅度模型:人机协作中的开发者角色转型与未来演进
生成式 AI 正进入软件开发流程,角色不断扩大。AI Coding Fluency 模型描述团队使用 AI 能力演进,从辅助到自主执行。AI 编程面临信任、上下文、任务设计挑战,关键在于协作方式。
NanoClaw:ClawdBot瘦身版,500行代码搞定
开发者因OpenClaw代码库复杂,开发出NanoClaw,核心代码仅500行。它运行在Apple容器,有安全设计,还增加Docker支持。虽跟随热度爆火,但‘nano’项目热度易逝,当下适合借鉴。
Qwen2.5VL又多一个娱乐场景,看电影讲故事
文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。
奥特曼回应OpenAI硬件抄袭:投资没谈拢就来反咬我!新一轮邮件证据曝光
奥特曼就OpenAI硬件“抄袭门”回应,称IYO投资不成就诉讼,还公布邮件证据。双方各执一词,争议不断。此外,OpenAI正为ChatGPT设计协作和聊天功能,与办公工具竞争。