「Claude 3.5/3.7 Sonnet」共找到 4767 篇相关文章
《动手写AI Agent》流式输出:别让用户干等着
文章围绕《动手写AI Agent》流式输出展开,指出此前Ling使用体验差,因无流式输出,用户等待久。介绍主流LLM流式接口基于SSE,对比OpenAI、火山引擎与Claude格式差异,并定义统一的StreamChunk类型。
Skills:从编程工具的配角到Agent研发的核心
文章探讨了Skills在AI Agent发展中的价值演变与适用场景,指出其价值具高度场景依赖性。在Claude Code编程工具中它表现平淡,在Agent研发中价值凸显,还给出使用场景判断维度与发展方向。
The Batch: 896 | 教会模型说出真相
大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。
奥特曼考虑给ChatGPT加广告了!用8亿用户,救万亿债务
OpenAI凭ChatGPT有8亿周活与约130亿美元年收入,因订阅难覆盖成本考虑加广告,还获软银巨额投资,豪赌算力扩张;Anthropic低调攻企业,Claude在专业领域强,收入逼近OpenAI一半,打法稳健。
蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王
蚂蚁开源团队推出 Ring-1T 模型,它结合强化学习与多阶段推理机制,实现从‘模仿’到‘思考’的转变。该模型在多基准测试表现优异,其高性能得益于 IcePop、C3PO++、ASystem 三项关键技术。
ChatGPT最强网络安全模型,逼谷歌紧急修漏洞!
OpenAI推出安全专用模型GPT-5.6-Cyber,用于处理信息安全任务。它战绩斐然,发现诸多内核漏洞。Daybreak计划为安全人员提供工具。该模型虽有不足,但展现出强大的网络安全能力。
DeepSeek 峰谷 Token 的开山鼻祖,原来是阿里这个桌面 Agent
文章介绍阿里桌面 Agent 工具 QoderWork,它是最早落地「峰谷 Token」的产品,晚上 Qwen3.7 - Max 模型 2 折。该工具功能丰富,能完成复杂任务,还把配置与使用分开,降低使用门槛。
Anthropic出手,一批Agent创业公司死去
Anthropic推出Claude Managed Agents,号称几天就能上线生产级智能体。它提供全托管、开箱即用的智能体基础设施,让传统SaaS公司与AI初创公司面临危机,AaaS时代正开启。
Redis之父:手写代码?醒醒吧除非你图一乐
Redis之父Antirez在博文指出,编程已被AI永远改变,手工写码不再明智。他用实测案例展示Claude Code强大效率,警告程序员别喝‘反AI迷魂汤’,应重构工作流拥抱AI。
新玩法!Karpathy周末手搓“大模型智囊团”应用:各大LLM同台互评,代码已开源
Andrej Karpathy周末手搓Web应用llm - council,让多个大模型像顾问般提供建议。查询通过OpenRouter分发给多个大模型,它们互评后由‘大模型主席’生成最终回复,代码已开源。