「社区标准」共找到 768 篇相关文章
刚刚,翁荔博客又上新:通过Harness工程实现AI自我提升
翁荔新博客聚焦Harness Engineering,梳理围绕‘Harness自我优化’的研究,探讨递归式自我提升发生层面,还指出自动化研究和自我提升系统面临的瓶颈,如评估标准模糊、奖励作弊等。
第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手
文章介绍用 `deepagents` 框架构建代码审查 Agent 的实战项目。此框架封装重复工作,让开发者专注业务逻辑。文中讲解其安装、最小运行示例,还介绍自定义工具及添加审查标准技能的方法。
编程脚手架狂揽 20 万星,Agent 基础设施成 GitHub 新战场
近日,GitHub Trending 榜首的「obra/superpowers」飙到近 20 万星。它是 AI 编程脚手架,能让 AI 按专业流程产出高质量代码,解决开发者难题。GitHub 上 Agent 基础设施项目爆发,各公司也在布局,工程标准争夺激烈。
AI不会减少工程师!Reddit疯抢应届生:“AI原生一代”必须毕业就招走
Reddit联合创始人兼CEO Steve Huffman表示,公司会大量招聘应届生,尤其是工程类岗位,认为AI不会减少工程师数量。他还复盘Reddit IPO成功原因,阐释平台在AI时代的不可替代性,强调社区真实性的重要性。
Moonshot AI发布Kimi Linear技术报告,采用混合线形注意力架构
Moonshot AI在Hugging Face发布Kimi Linear技术报告,该48B参数模型采用混合线性注意力架构,称超越传统全注意力机制。官方数据体现其优势,模型已开源,社区反应不一,MiniMax则回归全注意力架构。
阿里 Qwen 又双叒发模型,继基础、编程模型后,最强推理模型 Qwen3 Thinking 登场,击败Gemini 、R1?
阿里通义千问发布最强推理模型 Qwen3-235B-A22B-Thinking-2507,逻辑、通用技能等能力更强,原生支持 256K 上下文。此前已发布基础和编程模型,Qwen API 在 OpenRouter 表现佳,受社区关注。
有一说一,老周还真的挺懂 Agent 的
360 AI 发布会,老周回应市场部一事,称是让员工养成用 AI 习惯。他懂 Agent,认为其将成 AI 应用标准形态,360 从搜索切入,推出纳米 AI 超级搜索智能体,还发布两款 AI 硬件。
DeepSeek 官宣V3.1:迈向 Agent 时代的第一步!
DeepSeek 官宣发布 V3.1,称这是迈向 Agent 时代第一步。其有混合推理模式,Agent 能力全面进化,API 也全面升级,支持 Anthropic API 格式。还继续开源,9 月 5 日起调整价格,社区反响热烈。
DeepSeek-V3-0526 闪现后秒删!
Unsloth文档页面惊现DeepSeek新模型DeepSeek-V3-0526后秒删。该模型性能佳,团队还准备了技术描述。Daniel Han预测其可能端午节前发布,社区对此反应热烈,大家期待DeepSeek下一步动作。
当 Agent 成为新的核心云用户:阿里云重新定义“用云范式”
Agent 进入企业速度超预期,调用云资源使云平台需改变。阿里云发布云 Skills 门户,将云能力 Agent 化,通过三层体系处理不确定性,引入 SDD 规范调云链路,还强调开放标准的重要性。