「中等难度问题」共找到 3271 篇相关文章
AI 企业 Day 0 出海,如何少走技术弯路?
InfoQ与多家AI出海企业交流发现,很多企业放弃常见Agent平台和流行框架,选择自研全栈平台。GMI Cloud升级产品,构建完整基础设施图谱,解决全球算力部署、模型调用和Agent商业化落地问题。
Harness Engineering:AI 能在真正"出事会炸"的后端系统里写代码吗?
文章围绕AI能否在后端系统写代码展开,以腾讯CDN LEGO项目为例,介绍了项目背景与挑战,通过nonstop项目探测AI编码能力,分析AI Coding易翻车的问题及根因,构建Harness Engineering架构并实践,最终效率提升20%。
Reasoning模型可以Self-Train!
当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。
谷歌开始肢解DeepMind,数个团队被划归总部
DeepMind换帅一周后震荡持续,谷歌将拆分它,把部分非技术团队转入谷歌汇报体系。谷歌联合创始人谢尔盖·布林重新介入Gemini。此外,Gemini因算力、内讧、官僚等问题落后。
一年吃掉一块固态硬盘,Codex日志bug被骂「劣质软件」
OpenAI旗舰编程工具Codex因日志Bug,一年写入量达640TB,耗尽硬盘寿命。该问题4月就有反馈,拖两月才处理,仅减少约85%写入。Codex类似问题至少9个,AI编程工具质量引质疑。
Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认不达标为何不退钱?
8月至9月,Claude模型质量下降,Anthropic将问题归咎于三项基础设施漏洞。开发者不满,质疑官方用bug搪塞,要求退款。官方虽剖析问题并提出改进方案,但很多用户已不再买账,Claude用户流失问题持续数月。
华人团队让AI把表格“翻译”成问题,检索速度×5
表格检索在RAG里是小众问题,传统表格问答系统有Retriever和Reader组件,关键是对齐表格与问题语义。QGpT能生成模拟问题,使表格语义更丰富、对齐更准确,分离线、在线阶段,训练后可提升检索收益。
Claude神之bug:给自己下指令,还诬赖用户??Hacker News炸了
强如Claude也现诸多bug,如分不清发言角色,把恶意注入指令当用户请求。技术根源是Transformer架构注意力机制盲区。网友给出避坑方案,还吐槽Claude算力调整、计费乌龙等问题。
几月前的伤心事,ChatGPT突然翻出来提醒我?网友当场破防:太会捅刀子了!
今年4月,OpenAI发布ChatGPT「记忆」功能并不断升级,能形成个性化档案,但也带来问题,如提及伤心事、造成社死等,背后有无意的算法残忍和上下文崩塌两类问题。
奇点之前,一场关于Physical AI的闭门会议
过去一年,Physical AI成全球AI产业热门方向,诸多关键问题待解。今年9月,上海物理智能与机器人研究院将发起PAIR 2026闭门会议,聚焦未决技术问题,促进多方交流和资本配置。