「编程竞赛基准」共找到 2037 篇相关文章
3.3k星星!用AI做前端动效最好的开源项目,给AI写前端代码注入灵魂
现在AI编程做的前端效果不佳,页面不生动、特效生硬。而Text-to-Lottie开源框架可通过AI编程Agent快速生成生产级Lottie动画,支持多种输入,有实时预览与编辑功能,还能集成多平台,简化动效开发。
OpenAI发布GPT-5-Codex:独立编码7小时,能动态调整资源,token消耗更少
OpenAI发布专用于编程的GPT-5-Codex,属GPT-5特殊版本,有即时协作和独立执行的‘双模’特长。它能动态调整资源,token消耗少,擅代码审查。文中还介绍其命名由来及编程智能体竞争情况。
一年成爆款,狂斩 49.1k Star、200 万下载:Cline 不是开源 Cursor,却更胜一筹?!
AI编程助手看似热门,实则多数亏本运营。Cline选择开源,允许用户自由组合LLM编程,个人免费,企业服务收费。它一年成明星产品,获49.1k Star、近200万下载,其创始人分享了产品理念、发展等多方面思考。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3大核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。
吴恩达来信:建立为人类服务的智能体社群
吴恩达讨论编程智能体分享经验平台的可能性,介绍了解决编程智能体获取最新API文档问题的chub工具。他提出收集智能体反馈以更新文档,还受Moltbook和Stack Overflow启发,认为智能体贡献反馈很有价值。
字节Seed开源长线记忆多模态Agent,像人一样能听会看
字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。
一年成爆款,狂斩 49.1k Star、200 万下载:Cline 不是开源 Cursor,却更胜一筹?!
AI编程助手市场看似火热,实则盈利艰难,如Cursor等工具亏本运营。Cline选择开源,坚持软件免费、服务变现,一年成爆款。其创始人分享了产品理念、技术选型、市场定位等,还探讨了MCP生态、编程智能体发展等话题。
Anthropic逼急奥特曼:自砍副业,死磕Claude主场
OpenAI最高层拉响「红色警报」,准备砍掉边缘项目,全面退守编程与企业市场主赛道。此前其「全面押注」策略导致资源内耗,而Anthropic专注企业和编程市场取得成功,Claude Code年化收入超25亿美元。OpenAI反击,Codex用户量提升。
AI Coding大佬聊透了:产品智能重要还是用户体验重要?答案让人意外
量子位举办AI Coding沙龙,百度、硅心科技等多位行业玩家参与。探讨AI编程从替代人转向协作、智能体发展、To B与To C界限模糊等话题,指出未来产品智能更重要,编程产品将服务更广人群,程序员技能需转变。
实测DeepSeek V3.1,不止拓展上下文长度
文章实测了DeepSeek V3.1和V3,发现V3.1在编程、写作、翻译等方面有变化,如编程更全面、写作风格变文艺等。网友测试其在aider得分71.6%成非推理模型SOTA,但线上API有问题。