「18.0版本」共找到 1334 篇相关文章
LLM又曝致命缺陷:根本不会看时钟!博士惊呆,准确率不及50%
最新研究揭示AI存在认知缺陷,读取时钟准确率仅38.7%,判断日历日期准确率26.3%。研究者构建测试集考察MLLM能力,虽部分模型有亮点,但整体表现不佳,凸显训练数据和推理方式改进需求。
21
本文聚焦vllm v1中管控模型分布式推理的核心Executor部分,介绍其4种类型及适用场景,以mp类型为例阐述Executor - Workers架构,还说明了大小数据在两者间的传输机制及原理。
Anthropic曝光自家整套,AI原生研发手册
Anthropic 在官方博客发布两篇内部实践文章,《The AI-Native SDLC Playbook》讲 AI 承担多数编码工作时软件流程安排,《How Anthropic secures its AI-native software development lifecycle》谈流程自动化后安全体系建设。
Jeff Dean最新访谈:基础模型越来越强,小团队如何与谷歌等巨头竞争?
Jeff Dean 在 Y Combinator 活动中与 Diana Hu 对谈,探讨 AI 创业者面临的问题。他指出推理成新瓶颈,预计有更多推理硬件;Agent 执行复杂任务进步快;小团队可找 1%成功率问题;还提及稀缺能力及创业建议。
AI 真的能帮你微信下单了!
微信支付发布「AI 专属卡」,WorkBuddy 率先接入。用户在 WorkBuddy 能让 AI 找外卖、选套餐、领券、下单及支付。介绍了使用步骤,还说明 AI 专属卡支付安全,绑定还有彩蛋。
Markdown要凉…卡帕西也站HTML了
Anthropic工程师Thariq发文呼吁抛弃Markdown,力推HTML,认为其在信息密度、可读性等方面优于MD。卡帕西也认可此观点。不过HTML存在费token、版本控制难等问题,文中也给出了应对建议。
AI能改10万行代码,却让你走路去洗车!Karpathy戳破「锯齿状智能」
Karpathy在Sequoia AI Ascent 2026炉边谈话指出,AI能力呈锯齿状,背后是经济学问题。他还提及软件新地平线,认为Vibe Coding抬高编程地板,专业开发需智能体工程,人类在智能体时代是工程导演。
Anthropic封杀48小时,逼出OpenClaw最强反击!龙虾首次会生视频了
Anthropic封杀OpenClaw免费接口,OpenClaw推出2026.4.5王炸更新,支持视频生成和‘睡眠记忆’系统,还优化提示词缓存。虽与Anthropic有波折,也反映开源项目依赖大厂模型的困境。
GPT-5.4 发布,OpenClaw 要被替代?OpenAI 新模型会自己用电脑了,还顺手把编程能力拉满
今天,OpenAI 发布 GPT-5.4,将推理、编程和计算机使用能力整合,具备原生电脑操作能力,提升了工具使用效率。它成本降低、幻觉减少、编程能力更强,但 API 价格较高。其或与 OpenClaw 抢夺入口。
Anthropic 2026 Agentic Coding 趋势报告:软件开发的 8 大变革
Anthropic《2026 Agentic Coding Trends Report》基于企业实战数据,总结了AI编程Agent重塑软件开发的8大趋势,分基础、能力、影响三类,附企业案例,还给出2026年四大优先事项。