「前端开发测试」共找到 3235 篇相关文章
AI编程真面目:完整项目通过率仅27% | 上交大新基准
多校联合团队发布ProjDevBench,评估AI编程智能体端到端项目开发能力。结果显示,六种主流智能体总体提交AC率仅27.38%,从零构建任务中性能大幅下滑,还揭示了智能体多方面短板。
Swift 跨平台框架 Skip 现已完全开源
Skip 是用 Swift/SwiftUI 代码库创建 iOS 和 Android 应用的方案,经三年开发后团队将其完全开源,此前为付费方案。开源既是因开发者希望免费获工具,也为保证工具持久性,它能实现原生体验。
我烧了上亿token玩Clawdbot,结果发现国产平替更香,还免费。
作者花上亿token研究Clawdbot,发现其虽火但贵,Cowork也因收费和网络限制被盖过热度。作者转而探寻国内平替,介绍阿里云上线Moltbot云服务,重点推荐阿里QoderWork,测试后认为它是能打的免费平替。
5Y News|Kimi发布并开源 K2.5 模型,带来全新视觉理解、代码和Agent集群能力
2025年1月27日,月之暗面发布并开源Kimi K2.5模型,它是迄今最智能全能的模型,在多任务有出色表现。支持多模态输入,具备新能力,还推出Kimi Code工具,集群能力也开启Beta测试。
AI用3年时光,来了解你!首个AI Clone长期记忆基准
现有AI记忆评测存在数据源单一、忽视变化本质、注入成本高等局限。开源学术社区QuantaAlpha联合高校团队提出CloneMem基准测试,构建合成人生,设计评测任务,实验发现简单方法在检索上更有效,记忆系统应还原信息。
用2D先验自动生成3D标注,自动驾驶、具身智能有福了丨IDEA团队开源
IDEA团队张磊团队提出OVSeg3R开集3D实例分割学习新范式。它无需人工后处理和3D掩码标注,降低训练成本,有望让3D实例分割商业落地,可用于自动驾驶、智能家居等领域。
蚂蚁再把医疗AI卷出新高度!蚂蚁·安诊儿医疗大模型开源即SOTA
蚂蚁集团联合多方开源的医疗大模型蚂蚁·安诊儿(AntAngelMed),一经发布就登顶多项医疗基准测试榜单,是迄今参数规模最大的开源医疗模型,应用门槛低,为行业示范出一条清晰路径。
LTX-2开源:首个能同时生成视频和音频的模型
LTX-2开源,它是Lightricks团队开发的首个开源多模态基础模型,能联合生成音频和视频。采用非对称双流扩散变换器架构,用深度多语言文本编码器,速度比许多纯视频开源模型快,让模型理解声画关联。
年入103万美元!AI 独立开发者天花板!普通人应如何实践?
2026年初,法国独立开发者Marc Lou晒出2025年103万美元收入,他靠一人开发产品,利用AI工具快速迭代。他采用多产品矩阵、交叉推广等策略,也分析了中国独立开发者状况,给出入局建议。
GPT-5.2 发布:做表格、写 PPT、敲代码 | 打工人的生产力利器
GPT - 5.2发布,在GDPval评测等众多基准测试中刷新行业水平。GPT - 5.2 Thinking适合真实场景与专业工作,在知识型任务、编码、长上下文处理、视觉理解、工具调用等方面表现出色,部分功能需付费使用。