代码模型」共找到 8677 篇相关文章

新闻资讯7

爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?

第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。

InfoQ
开源动态8

全球首次实测通过!CMU华人用AI设计的乐高「不翻车」

CMU研究人员提出LegoGPT,它微调Meta的LLaMA模型,结合47000个稳定结构数据集,确保98.8%的乐高设计符合物理定律,可实际搭建。目前,数据集、代码模型均已开源。

新智元
开源动态8

狂赚 21.6K star!超牛的Cursor免费平替项目,隐私友好、功能超强,真的香!

开源君分享了开源AI代码编辑器Void,它是基于VS Code魔改的「开源版Cursor」,保留VS Code优点,AI辅助编码出色。在Github获21.6K star,有隐私保护等特色,操作简单易上手。

开源先锋
产品应用7

全靠Claude4!30年FAANG老工程师:AI帮我解决了4年老bug

5月22日Anthropic推出Claude 4系列大模型,Claude Opus 4是领先编码模型。Reddit上30多年经验的前FAANG工程师称,它解决了困扰自己4年的C++ Bug,引发热烈讨论。

机器之心
新闻资讯9

The Batch: 981 | Ox Alpha 被揭晓为 GLM-5.3-Flash

本文是DeeplearningAI The Batch专栏的AI行业资讯,揭秘此前匿名上线爆火的Ox Alpha模型,公开其为Z.ai推出的GLM-5.3-Flash,详细介绍该模型的架构、性能、定价与授权信息。

DeeplearningAI
产品应用7

Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦

Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。

AI科技评论
推荐文章8

狼人杀AI对决:手把手教你打造高分Agent

作者参加AI狼人杀比赛,分享构建高分Agent全过程。介绍比赛规则、题目挑战及解题思路,阐述Agent基础能力,如缓存、并发集成等,还提及模型调优、战术策略,最后开源代码,分享心得体会。

阿里云开发者
新闻资讯7

The Batch: 940 |Claude Mythos Preview 引发安全担忧

Anthropic为即将推出的Claude Mythos Preview采取特别预备措施,因其会带来网络安全风险。该模型能力强大,能发现众多代码漏洞。Anthropic组建联盟增强防御,其表现也优于多个知名模型

DeeplearningAI
算法论文7

AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。

量子位
开源动态8

国产开源LLM迎来大爆发的一周:Kimi、腾讯、快手、美团、面壁智能

国产开源大模型迎来爆发,快手、月之暗面、美团、面壁智能、腾讯等接连发布新模型,如快手Keye-VL - 1.5 - 8B刷新视频理解SOTA,美团LongCat - Flash - Chat推理快成本低等。

PaperAgent