「AI推理系统」共找到 11680 篇相关文章
Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用大模型气得我自己写代码都有劲儿了
Redis 之父 Antirez 分享研发经历,认为人类程序员比大模型出色,人类能打破常规想出更有效解法。他在修复 Redis 复杂 bug 时,与 Gemini 2.5 PRO 交流,凸显人类创造力优势。开发者看法不一,AI 虽成工具但缺创造力。
本周 5 个 YYDS 开源项目,真的很6!
本文推荐本周5个开源项目,有将命令行与图形化工具集成的waveterm,能转换AI输出格式的PasteMD,总结Vibe coding的vibe - coding - cn,录屏剪辑工具openscreen,还有年会抽奖系统log - lottery。
科研智能体「漫游指南」—助你构建领域专属科研智能体
该综述提供科研智能体构建指南,提出三级分级系统,阐述构建流程与能力增强方法,涵盖知识组织、注入、工具集成,还提及基准评估和未来研究方向,促进AI与自然科学融合。
刚刚,马斯克发布Grok 4!全榜第一,年费飚到2万+
北京时间中午,马斯克现身 xAI 发布会发布 Grok 4,称其是世界最好的 AI。Grok 4 推理能力强,多类基准测试成绩领先,还在多方面能力获加强,已上线但付费昂贵。
Lilian Weng:Harness才是模型自我迭代的现实起点和关键,而不是直接重写权重
Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型的执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临的瓶颈。
深夜炸场!Claude Sonnet 4.5上线,自主编程30小时,网友实测:一次调用重构代码库,新增3000行代码却运行失败
Anthropic推出Claude Sonnet 4.5,号称‘世界上最好的编码模型’,持续运行时长、推理等能力提升,‘幻觉’等问题改进,Claude Code也有更新,开发者实测有惊喜也有问题,新一轮AI‘内卷’开启。
Google这个1.5w star 项目牛皮,99%准确率!
Google安全团队开源AI文件类型检测工具Magika,抛弃固定规则匹配,用深度学习精准识别文件真实类型。它内置轻量模型,单CPU毫秒级推理,支持200+格式,准确率约99%,已大规模落地。
翻译界的ChatGPT时刻!Meta发布新模型,几段示例学会冷门新语言
Meta人工智能研究团队发布Omnilingual ASR系统,能识别1600多种语言,可通过少量示例快速学会新语言。它以开源与社区共创为核心,打破语言技术不平等,让更多语言登上AI舞台。
GPT-5.4 vs Opus 4.6 vs Gemini 3.1:五条结论
2026年3月前沿AI竞争激烈,GPT - 5.4、Opus 4.6、Gemini 3.1 Pro各有千秋。GPT - 5.4领先知识和计算机使用,Gemini 3.1 Pro以低价主导推理,Opus 4.6编程能力强,无单一模型通吃各领域。
Vibe Coding 再升级,做世界顶尖的 Agentic Engineering!
过去18个月,AI Coding工具从‘辅助补全’到‘独立编程’质变,决定Agent产出质量核心变量从模型能力转向工程系统。文章探讨工程师角色迁移、Context Engineering、对抗Agent缺陷、长期维护及发展路径等问题。