可验证推理」共找到 6130 篇相关文章

新闻资讯8

Karpathy 亲手终结了RAG的草莽时代

Andrej Karpathy分享“LLM Wiki”工作流,将多数Token用于构建“演化知识库”。此方法不依赖复杂架构,在中等规模数据集上展现出强大能力,引发“LLM Wiki杀死RAG”的讨论,在技术社区和企业级市场反响热烈。

InfoQ
推荐文章7

通过架构建议流程实现架构决策的去中心化

Andrew Harmel - Law 在 Goto 大会提出架构建议流程,认为传统架构实践不扩展,架构需去中心化。该流程让任何人做决策,只需向受影响者和专家寻求建议,还提到失效模式及实践转变。

InfoQ
开源动态8

GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!

GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。

开源星探
产品应用8

OpenAI Codex桌面版深夜突袭!一人指挥Agent军团,程序员彻底告别996

OpenAI推出编码杀器Codex桌面App,指挥多Agent并行协作。它能多任务并行切换,创建调用Skills,设置自动化流程,从写代码进化到解决问题,还具备双人格模式,默认安全,有望重塑开发者与代码交互逻辑。

新智元
产品应用8

全球首个负载100斤的真实持续干活机器人,来自银河通用

银河通用发布具身智能重载机器人Galbot S1,双臂最大负载50公斤,突破行业上限。它搭载具身搬运模型,全自主作业,已在宁德时代等企业产线应用,标志具身智能融入产业升级主航道。

量子位
开源动态8

Emu3.5:能够原生预测下一状态的多模态世界模型,媲美Nano Banana

北京智源研究院推出多模态世界模型Emu3.5,能原生预测视觉和语言下一状态。用超10万亿token数据预训练,后经强化学习训练。团队提出DiDA提升推理效率,其性能媲美Nano Banana,项目已开源。

AI工程化
新闻资讯7

甲骨文推出全球最大AI超算,作为OpenAI「星际之门」算力核心

甲骨文于2025年AI World大会发布全球最大云端AI超算「OCI Zettascale10」,成OpenAI「星际之门」算力核心。其独创Acceleron RoCE网络提升性能与能效,但16 ZFLOPS算力待验证,甲骨文还推积分计划吸引客户。

新智元
新闻资讯8

Mamba-3惊现AI顶会ICLR 2026!CMU知名华人教授一作首代工作AI圈爆红

Transformer有力挑战者Mamba的最新版本Mamba-3进入ICLR 2026盲审。它有三大改进,在长文本处理、实时推理和成本优化有优势。此外,FBAM也从不同角度探索Transformer下一代框架。

新智元
新闻资讯8

为什么 OpenAI 们都要搞 AI 基建?Groq 创始人把背后的逻辑讲透了

文章通过对Groq创始人Jonathan Ross的访谈,探讨AI基建问题。指出AI应用增长受限算力,算力提升易见效,自研芯片掌控命运。还分析芯片制造难点、市场供需、能源需求等,预测AI将带来用工短缺和新产业。

Founder Park
开源动态8

8B硬刚72B!MiniCPM-V 4.5技术报告正式出炉

行业首个具备“高刷”视频理解能力的多模态模型MiniCPM-V 4.5技术报告发布,提出三项关键技术,使模型在多任务达同级SOTA,8B参数规模超72B模型,推理快,开源后获社区好评。

量子位