「开源软件」共找到 3468 篇相关文章
浪费20亿Token之后,我做了一个帮自己定义目标的Skill。
作者在浪费20亿Token后,开源了帮定义目标的Leader.skill。它能将模糊需求转为清晰目标,适用于多模型组合。还阐述人类与Agent交互范式转变及目标定义要点,给出目标七问方法论。
刷榜AI全挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分
Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9大顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。
从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓
4月16 - 18日QCon全球软件开发大会·北京站(2026)圆满举办,超2000人参与。多位技术领袖围绕AI与工程实践分享见解,大会还设25大专题。最后揭晓17位优秀出品人和29位明星讲师。
GPU利用率不到15%,AI产业最大的浪费正在被这家公司改写|甲子光年
AI产业发展中算力成本高、利用率低问题凸显。趋动科技押注‘软件定义GPU’,试图把独占GPU变为共享算力池,其产品使客户GPU利用率平均提升约4倍,已服务超200家头部客户。
具身AI当立!这是我分析完7篇最新Paper得出的结论~
作者分析7篇来自蚂蚁、小米、高德的具身AI论文,认为行业要变天。蚂蚁打通全链路并开源,小米让VLA在消费级显卡跑,高德重构数据和架构。具身AI正从‘手工业’走向‘工业革命’。
学界大佬吵架金句不断,智谱和MiniMax太优秀被点名,Agent竟然能写GPU内核了?!
卡内基梅隆大学助理教授蒂姆·德特默斯与加州大学圣地亚哥分校助理教授丹·傅,就AGI是否会实现展开争论。他们还谈到算力、Agent应用等话题,看好小模型、开源模型等发展,认可中国大模型进步。
谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了
在全球人工智能竞争升温之际,谷歌与 OpenAI 同日更新。谷歌推出全新 Gemini Deep Research 工具,能力提升显著,还开源基准、推交互 API;OpenAI 发布 GPT - 5.2。两者竞争激烈,差距微小,都在争夺智能体框架标准主导权。
AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星
香港大学黄超团队开源的DeepCode,能分析论文、生成可运行代码。在四大基准测试中全面领先,首超人类专家,还优于现有AI Coding。它有三大核心能力,采用三阶段框架实现代码自动转换。
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。
AI 产品定价指南:按量定价的卡点到底是什么?
本文编译 a16z 与 Scott Woody 访谈,探讨 AI 改变软件定价逻辑及企业应对策略,还补充定价专家 Madhavan Ramanujam 关于 AI 产品定价四象限观点,指出按量定价的难点、适用模式及企业转型要点等。