人机结对编程」共找到 1264 篇相关文章

推荐文章7

用AI写代码的真实体验:聪明却“不靠谱”的顾问,你敢用吗?

作者Luke Kanies曾是AI与LLM怀疑者,试用Vibe Coding后,认为要把AI当不太靠谱的外部顾问。用AI学Swift编程,发现它是糟糕架构师,但找语法错误快,相处中可让其做琐碎工作,不能全信它。

宝玉AI
推荐文章8

同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?

编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。

AIGC开放社区
新闻资讯7

硅谷天选之女,刷脸刷出3500亿独角兽!

外媒消息称,几乎0模型、0产品的Thinking Machines Lab欲融资40 - 50亿美元,估值达500亿美元。其创始人Mira Murati出身不凡,曾在OpenAI担任CTO。公司首个产品Tinker是应用程序编程接口。当下AI市场泡沫大,投资风向现分裂。

新智元
新闻资讯7

Claude 小升级就赢了OpenAI 9年“开源神作”?高强度推理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?

OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌Deepmind推Genie 3,Anthropic放出Claude Opus 4.1。Claude Opus 4.1编程性能提升,实测编码能力强于gpt - oss。gpt - oss虽有亮点,但幻觉率高、实测效果不佳。

AI前线
上一页127 / 127下一页