「视觉编程」共找到 1708 篇相关文章
突发!曝阿里通义薄列峰离职,此前为应用视觉团队负责人
五一节后爆料阿里通义实验室应用视觉团队负责人薄列峰于4月30日离职。他曾带领团队做出爆款功能,现加入某互联网大厂。今年2月语音团队负责人鄢志杰也已离职,接替人选均成谜。
真卷啊,AI编程老祖Devin估值反超Cursor了
AI编程赛道竞争激烈。Devin开发商Cognition年化收入逼近10亿美元,新融资估值目标400亿美元,将反超Cursor。其收入倍数收窄,有真实增长,新技术能3秒配好开发环境,产品走智能体路线。
GPT-5几个预测:用户翻倍,编程登顶,屠杀一众模型
OpenAI发布GPT-5,登顶大模型测评榜单。它有统一智能架构,在多测试取得突破,编程能力强击败对手。还改进意图,减少幻觉、增加情感、在健康领域更实用,价格便宜。作者预测其将带来用户翻倍等影响。
AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA
MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。
视觉模型既懂语义,又能还原细节,南洋理工&商汤提出棱镜假说
南洋理工与商汤团队提出 Prism Hypothesis(棱镜假说)与 Unified Autoencoding(UAE)。论文指出视觉基础模型中语义理解和像素保真很难兼得,用频率谱统一视角解决冲突,UAE 实验效果良好。
拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?
现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。
拜拜Claude!阿里最强万亿模型编程秒了Opus4,实测在此
阿里推出总参数达1万亿的Qwen3 - Max - Preview (Instruct),比前一代Qwen3(235B)强四倍,发布即上线。官方测评显示它打败Claude Opus 4等对手,实测其编程能力出色,后续正式版值得期待。
一手奶瓶一手键盘!新手宝妈产假氛围编程,自研实用家庭App
新加坡宝妈Laura Zaccaria产假自研家庭餐食规划App。她无编程背景,靠Cursor等工具学习。AI迭代快,她意识到要跟上,产假成自我进化契机,提醒大家学习才能不被时代抛下。
挑战 Claude Code,9.5 万星!又一款开源 AI 编程神器火了
开源AI编程工具OpenCode亮相,具备原生终端界面、多会话支持,兼容75种以上模型,提供桌面版和IDE插件。它允许沿用付费订阅,内置免费模型,与多种LSP服务器整合,适配多种编辑器,采用‘隐私优先’架构设计。
5.1K Star!Codebuff 把整个 AI 编程团队装进你的终端!
Codebuff是开源AI编程助手,获超5.1k stars。其多智能体架构让不同智能体分工协作,理解代码上下文更好、编辑更准。官方测试中完成率61%,超Claude Code。它免费且上手简单,还能创建自定义智能体。