编程任务」共找到 2886 篇相关文章

产品应用7

The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者

Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。

DeeplearningAI
算法论文8

让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍

香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。

机器之心
开源动态8

一个只有70行的文件,凭什么拿下GitHub 10万星?

GitHub上‘andrej - karpathy - skills’项目爆火,核心是不到70行的CLAUDE.md文件,给出AI编程助手行为准则。其火的原因有解决痛点、名人背书等,价值在于证明‘上下文工程’重要。

AI Reading Hub
算法论文8

阿里SkillClaw:让 Agent 技能在真实使用中集体进化

当前LLM Agent依赖可复用技能完成任务,但技能部署后静态不变,改进仅停留在当前会话。阿里SkillClaw提出中心化进化架构,将多用户交互作为技能改进信号,通过Agentic Evolver更新技能,经夜间验证后部署。

PaperAgent
开源动态8

单Agent时代正式结束:一个干不过,就上300个

月之暗面发布并开源 Kimi K2.6 模型,热度高。它强化 Agent 团队协作能力,核心能力进步,领先对手。在编程领域发力,长程编码能力突破,集群协同输出强,还适配框架,实测效果出色,Claw 群组开启内测。

机器之心
推荐文章7

存量代码库难适配、人机边界模糊?百度拆解Coding Agent企业级落地的硬核解法

本文基于百度资深研发工程师颜志杰在2025 AICon大会演讲整理,剖析Coding Agent企业级落地三大挑战,分享百度“知识体系 + Rules建设”等实践,揭示开发者构建工程配套跨越代际鸿沟的方法。

InfoQ
新闻资讯8

OpenAI 也把工程师经验“蒸馏”进 skill 了!Harness 爆文作者曝内部玩法:一个百万行代码系统,全程零人工编码和审核

OpenAI的Ryan Lopopolo分享Frontier团队工作方式,他们维护超百万行代码库,零人工编码和审核。实验产出Symphony,推动coding agent成“队友”。还探讨模型使用、构建速度、人类角色等问题,认为人成瓶颈,软件要适配模型。

InfoQ
新闻资讯8

突然袭击!刚刚,Meta超级智能团队首个大模型来了

Meta超级智能实验室推出首个模型Muse Spark,由Alexandr Wang带领团队打造。它具备多能力,定位为构建个人超级智能基础,在多方面表现出色,Meta还研究其扩展维度。

机器之心
新闻资讯7

一场机器人黑客松,让具身智能的差距与机会同时显形

作者参加深圳机器人黑客松,这是全球最大规模线下具身智能开发者大赛之一。3天内参赛队伍可完成从数据采集到真机部署闭环。比赛让行业差距与机会显形,凸显基模重要性,自变量也给出新方向。

InfoQ
新闻资讯7

刚刚,Anthropic王炸Claude泄露!全面碾压Opus 4.6引爆全网

因「人为配置」错误,Anthropic最强模型Claude Mythos细节泄露。它编程、推理能力超Claude Opus 4.6,还具备网络攻防能力,但也带来安全风险,Anthropic因担心被黑客利用暂未发布。

新智元