「质量因子库」共找到 1955 篇相关文章
标准化3D生成质量榜单来了!首创层次化评价体系,告别“谁的demo更吸睛”主观评估
Hi3DEval团队推出面向3D内容生成的全新层次化自动评测体系Hi3DEval,设计对象级、部件级与材质主题三层评测协议,在HuggingFace发布首期3D生成榜单,涵盖30个主流与前沿模型。
从兼职工程师直接跳到CTO,他用两个月让一款 Agent 干掉60%复杂工作并放话:“代码质量与产品成功没有直接关系”!
金融科技公司 Block 的 CTO Dhanji R. Prasanna 分享公司 AI 转型经验。Block 在 8 周内部署 AI 智能体,推出开源 AI Agent 框架 Goose,能节省员工工时,还谈到组织变革、AI 应用及招聘等多方面见解。
AI“氛围编程”威胁开源,维护者面临危机
开源维护者正加速关闭外部贡献,因AI生成贡献量大质低。研究显示“氛围编程”会造成负反馈循环,降低软件可用性和质量。平台激励加剧问题,虽有应对策略但效果不佳。
MiniMax开源技能包:让AI写代码从大学生变资深工程师
MiniMax 官方开源 skills 仓库,能提升 AI 写代码质量,从‘大学生水平’升为‘5年+资深工程师’。其覆盖多种开发场景,支持四种主流 AI 编程工具,配置后重启可用,具体效果因场景而异。
AI 太烧钱!微软选择「倒戈」DeepSeek
微软宣布Copilot Cowork全球上线并引入按使用量计费机制,还评估引入DeepSeek V4。Agent普及使AI成本问题凸显,微软进行系统性重构,构建质量保障体系,成本工程化能力成竞争新焦点。
LinearRAG:一种免关系提取的高效 GraphRAG 图构建方法
研究指出 GraphRAG 模型在实际应用中表现常不如朴素 RAG 方法,原因是自动构建的知识图谱质量不佳。为此提出 LinearRAG 框架,有三大核心创新,在四大基准数据集上全面超越现有方法,代码和数据已开源。
突发!arXiv CS新规:未经同行评审,一律不收
arXiv CS板块新规,「综述/调研」和「立场」类论文须经同行评审才可收录。因LLM生成论文激增,此类无实质价值论文增多。但学界大佬对此不满,认为会误杀优质内容,拖慢成果发布。
被喷了……我索性扔出价值过万的 AI 编程 prompt
作者因招聘要求被喷,索性分享价值过万的 AI 编程 prompt。介绍招聘需把控 AI 产出质量,还讲了完整表达需求、完善文档、过程监督等编程要点,最后给出杀手级 prompt 并预告下文。
Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?
8 - 9 月初Claude模型质量下降,Anthropic发文解释是因三项基础设施漏洞。介绍了三个bug及处理办法,也分析检测难的原因并给出改进方案,但很多用户已不再买账,Claude用户流失问题持续。
陶哲轩官宣AI数学基金首轮名单:29个项目瓜分1.3亿,数学界沸腾!
陶哲轩担任顾问的AI数学基金公布首批获资助项目,因提案质量高,资助金额从900万美元翻倍至1800万美元。首轮29个项目来自多所名校,单个项目最高获100万美元,旨在推动数学与AI结合。