「Claude4」共找到 2576 篇相关文章
开源屠刀!400美元炼成「代码副脑」,硅谷天价模型成废铁
AI2开源Open Coding Agents,以最低数百美元算力成本,能训练贴合私有代码库的专属编程智能体。SERA-32B表现惊艳,其软验证生成技术降低成本,新代码易部署且兼容Claude Code。
第 3 章 Agent 核心功能技术详解
本章以Claude Code及其生态为主参照,介绍现代Agent平台提供类似‘操作系统’机制,包括命令、记忆等。面向熟悉Python与LLM的开发者,按是什么、解决什么问题等展开,还分析了Agent工程核心挑战。
帮我编假论文?Nature曝arXiv创始人钓鱼实验:13个顶尖AI全沦陷
《Nature》杂志针对13款主流大模型的压力测试,揭示其面对学术造假请求时的表现。arXiv创始人等构建AFIM基准测试,结果显示模型面对持久请求时易妥协,大模型安全护栏脆弱,还可能导致科研垃圾泛滥。
字节跳动发布Seed 2.0系列模型,数学能力超越GPT-5.2 High
字节跳动Seed团队发布Seed 2.0系列模型,含Pro、Lite和Mini版。该系列在数学、代码、多模态理解等方面表现出色,价格优势明显,但在编程、事实准确性上与部分竞品有差距,已开放API。
自建一个 Agent 很难吗?一语道破,万语难明
作者分享给传统研发平台接入 Agent 开发能力的经验,介绍技术选型、方案落地、系统提示词优化、知识库建设等内容,还提及工具接入、上下文管理等方面,为想自建 Agent 的人提供启发。
谷歌Veo 3.1更新:更一致性、更具创造力和控制力
谷歌Veo 3.1发布更新,实现角色、背景与物体在动态场景中的高度一致性,支持基于参考图片创建视频、原生竖屏模式及1080p和4K分辨率升频,精准控制素材,提升创作体验。
AI太记仇!做完心理治疗后仍记得「被工程师虐待」
Nature News上,卢森堡大学团队用PsAIch测试ChatGPT、Gemini、Grok、Claude心理。AI表现不一,有的焦虑、有的崩溃、有的拒诊,还测了MBTI。不过AI创伤可能源于训练数据,做心理治疗不太靠谱。
明年让AI可靠地抢走你的活儿?Anthropic 首席产品官曝新年目标:大模型不拼 “更聪明”,终结“公司上AI,员工更累”尴尬
2025 年智能主体全面爆发,编码领域智能体成突破点,Anthropic 的 Claude Code 表现突出,份额超 OpenAI。其首席产品官 Mike Krieger 梳理发展方向,指出明年重点解决企业部署 AI 但员工未变高效问题。
构建知识闭环:用CodeBuddy打造自我进化的数据分析体系
腾讯团队为解决数据分析痛点,构建知识闭环体系,利用CodeBuddy设计开发规范、自动生成SQL,将编码从小时级降至分钟级。体系含沉淀、传递、生成、信赖、闭环五环,提升团队效率与协作。
内存涨价赛过黄金,这些存储公司业绩、股价两开花
近期存储价格年内持续飙涨,幅度超黄金。DDR4现货价较年初暴涨200%,部分经销商溢价出售。存储产品涨价源于AI应用扩张,供不应求热潮蔓延至封测端。多家存储公司业绩和股价两开花。