「token 接受率」共找到 1019 篇相关文章
RAG效果不佳?先别急着微调模型,这几个关键节点才是优化重点
文章深入探讨RAG技术实现与优化,指出其在AI应用开发中常被当黑盒,从文档分块、索引增强、编码、混合检索到重排序等关键环节解析,强调结合场景调优以提升召回与精确率。
不靠高薪靠信仰!以文化破局,Anthropic凭「使命驱动」杀出AI人才血路
顶尖AI人才争夺战在科技巨头间白热化,Meta等不惜高薪抢夺。但Claude开发商Anthropic工程师净增长率超对手,它不靠高薪,凭“使命驱动”和独特文化吸引人才,其经验值得国内AI初创企业学习。
Agent 跑分追平 Codex、成本低至 1.95 美元,这家中国公司做到了
德勤报告显示86%多Agent项目落地失败,硅谷也出现‘无限智能体死循环’。EvoMap团队的EvoX采用‘蜂群式自进化’打法,系统容错率翻倍、完成率跃升,成本大幅降低。跑分追平Codex,还展现出自组织潜力。
解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体
浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优化方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。
18 天做出来的产品,一个月留存 1%。OpenAI 抄袭 Skills?
2025下半年科技行业重速度,OpenAI开发Sora安卓应用仅18天,国内产品也纷纷发布。但快也有问题,Sora 30天用户留存率仅1%。此外,OpenAI人才策略激进,还被指抄袭。做产品应兼顾快慢。
GLM-5登顶开源模型No.1!智力指数首破50大关,打平Opus 4.5
在Artificial Analysis评测中,GLM - 5成开源权重模型智力排名第一,是首个智力指数破50的开源模型,除代码能力外各方面表现出色。它集成DeepSeek稀疏注意力,参数规模大,擅长“搞钱”任务,幻觉率低且输出精简。
提前实测Opus 5:3D细节封神,然而有一个致命缺陷
全网苦等Opus 5,结果其暂缓发布,理由是怕威胁人类对高级AI的控制,遭网友怒批。部分开发者提前实测,它3D细节表现出色,但耗token且看图测试翻车,原定有诸多强大特性。
Claude灾难级大宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷
4月6日Claude新功能Ultraplan上线就遭遇大规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗大,Anthropic太急,产品稳定性堪忧。
State of AI 2025:霍桑效应下,AI 是「赚钱机器」还是「泡沫机器」?
Air Street Capital发布2025年度《State of AI Report》,证实AI成重要经济增长动力,但技术突进伴随矛盾。报告提及AI推理能力有‘霍桑效应’,或成泡沫,不过AI - first公司商业化加速,付费工具采用率和合同价值飙升。
Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!
国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本低、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。