「规范驱动开发」共找到 2162 篇相关文章
小红书开源大模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……
小红书hi lab团队公布首个开源大模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度大,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。
DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单
在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。
微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星
微软在官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,在Github超4000颗星,支持MIT许可证商用。
“由 AI 生成的代码,从诞生那一刻起就是「遗留代码」!”
如今生成式AI融入软件开发,AI生成的代码一诞生或被视为“遗留代码”。它缺乏上下文记忆和维护连续性,虽有开发者尝试弥补,但代码未来或多靠提示生成。文章观点在Hacker News引发讨论。
Gemini 2.5 Pro强势更新并霸榜,Claude 3.7首次遭遇全方位碾压!
Google DeepMind推出的Gemini 2.5 Pro在LMArena各大排行榜全面登顶,实现文本、视觉、Web开发全方位霸榜,编码能力也大幅升级。虽有质疑,但短期内难有对手,还引发对Google I/O大会更多惊喜的期待。
御三家都在押注的 Loops,代码怎么还是垃圾?
在AIE World's Fair大会的《伟大的Loops》辩论赛上,正反方就Loops展开激烈交锋。正方认为Loops配得上热度,是迈向软件工厂关键一步;反方则指出其炒作与实际效果差距大,当前做法有误。双方还探讨了安全性、可用性、开销等问题。
AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法
在AI驱动的数据应用场景中,Kafka、Iceberg开放表格式与对象存储组合成流数据入湖重要方向。传统ETL方式有链路长等问题,文章围绕“零ETL”讨论架构减法,介绍Kafka × Table Bucket方案及优势、适用场景。
白嫖10余家AI服务,一个接口全搞定,爽了!
现在主流AI厂商虽有免费额度,但使用起来接口、SDK、限流规则等差异大,适配麻烦。freellmapi项目将Google Gemini等十几家AI平台免费Tier聚合,对外一个接口,自动调度、切换和限速,适合做AI原型开发等。
14.8K Star!这个开源 Skill,一句话就能做出大厂级设计!
Anthropic 发布的 Claude Design 虽能在对话框生成网页,但需手动操作。有人据此开发了开源项目 Huashu Design,可在 agent 里打一句话,3 到 30 分钟就能拿到能交付的设计,还介绍了其功能、核心规则等。
近亿元融资落定!隼瞻科技加速芯片设计"敏捷革命"
近日,隼瞻科技完成近亿元天使+轮融资,多家知名战略投资人加入,老股东继续加持。该公司是国内唯一‘IP货架 + EDA工具’双轮驱动企业,自研平台可大幅缩短设计时长,成立三年已迈向规模化落地。