写码能力」共找到 3781 篇相关文章

新闻资讯8

炸裂!Claude以第一作者论文反驳苹果「推理模型根本没有推理能力」:苹果有三大错误

苹果论文称推理模型无推理能力,引发争议。Anthropic的Claude Opus以第一作者论文反击,指出苹果研究有混淆‘推理失败’与‘输出截断’等三大问题,还通过实验证明模型能力,强调需更聪明评估方法。

AI寒武纪
推荐文章7

AI 编程越来越厉害了,我要怎么提升自己的系统架构能力

文章指出 AI 能力提升,对程序员系统架构能力要求更高且难被替代。介绍系统设计概念,分析做系统设计的难点,给出新人提升系统设计能力的方法,还说明 AI 可辅助提升该能力

宝玉AI
产品应用8

准确率轻松翻倍!不烧钱微调,AI靠“日记”实现能力跃升

Memento - Skills系统抛弃大量算力微调模型参数的方式,靠读反思、“日记”式学习机制,在不改变模型参数下实现能力跃升,在GAIA和HLE基准实验中准确率显著提高。

AIGC开放社区
产品应用7

时隔一年,再次使用7个国产AI大模型高考作文,国产模型的进步也太大了!有彩蛋。

去年评测国产模型高考作文能力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型,能力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。

开源AI项目落地
产品应用8

GPT-5.4 发布,OpenClaw的能力要被取代?OpenAI 新模型不仅会自己用电脑,编程能力也拉满了

今天 GPT-5.4 发布,整合推理、编程及原生计算机使用能力。其原生电脑操作能力提升,与 OpenClaw 竞争。还带来工具搜索降成本、减少幻觉,编程能力增强但价格也升级。

AI前线
新闻资讯7

Llama惨遭抛弃!Meta内部改用Claude

据Meta工程师透露,Meta内部开发已弃用自家Llama,改用Claude Sonnet。Llama 4风评不佳,有人怀疑Llama 5是否会推出。Claude能力一流,其背后公司收入增长快。

量子位
算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
产品应用8

OpenAI 发了一份《好文档指南》|文档,是一种同理心的体现

OpenAI发布《好文档指南》,强调文档是为把信息装进别人脑子,是同理心的体现。给出让人能扫、好读、更多人看懂等原则,如拆分内容、句子简洁等,还指出必要时可打破规则。

AI进修生
新闻资讯7

Claude Opus 4.1代实测惊人!OpenAI开源模型却只会屎山?

昨日,OpenAI、谷歌和Anthropic等发布新模型。Anthropic推出Claude Opus 4.1,虽性能提升不大,但编能力获大客户认可。实测显示Claude - Opus - 4.1稳,OpenAI新模型表现不佳。

新智元
产品应用7

新DeepSeek R1代能力直逼Claude 4!附生成任何优质网站的通用提示词

作者体验DeepSeek R1超8小时,发现其文本作问题大幅修复,思维链推理改进,代能力提升,前端审美直逼Claude 4。文章展示其前端能力,给出前端网页提示词及设计逻辑,还探讨了其在复杂任务中的表现。

花叔
上一页1 / 379下一页