「轻量级验证器」共找到 1117 篇相关文章
AI版Chrome终于来了
Google正式推出Gemini in Chrome功能,将Gemini整合进Chrome浏览器。Chrome从‘内容展示器’变为‘内容理解器’,有多标签页处理等功能,提升效率,还推动浏览器形态演进,未来或能替用户操作。
Langchain回应OpenAI:为什么我们不做拖拉拽工作流
OpenAI发布可视化工作流构建器AgentKit,LangChain创始人Harrison Chase写文解释为何不做。他指出工作流与智能体不同,可视化工作流构建器有门槛高、难管理等问题,还给出不同复杂度问题的解决方案。
如何实现可验证的Agentic Workflow?MermaidFlow开启安全、稳健的智能体流程新范式
随着大语言模型发展,多智能体系统成新前沿,「Agentic Workflow」受关注。但现有系统存在合理性难保证等问题。新加坡和南洋理工团队推出MermaidFlow,以Mermaid语言显式建模工作流,提升可解释性与可控性,实验性能优秀。
全球最强开源「定理证明器」出世!十位华人核心,8B暴击671B DeepSeek
八大顶尖机构推出开源定理证明器Goedel - Prover - V2,有32B和8B两版本。它在多个基准测试击败671B的DeepSeek - Prover,采用创新技术,以少算力刷爆SOTA,十位华人是核心贡献者。
刚刚!UCLA杨林团队证明:仅凭提示词,Gemini 2.5 Pro就可以拿到IMO2025金牌
加州大学洛杉矶分校杨林和黄溢辰撰写论文,阐述利用Gemini 2.5 Pro解决2025年IMO竞赛5道题达金牌水平。设计解题者和验证者构成的自我验证流水线,用双提示词系统迭代,还规避数据污染问题。
从打分器到思考者:RM-R1用推理重塑模型价值判断
伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。
GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!
GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器可自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。
支持30种语言,多种中文方言 [四川话、粤语等]的颠覆性无分词器TTS系统
VoxCPM是无离散音频分词器的语音合成系统。VoxCPM2基于MiniCPM - 4构建,有20亿参数,支持30种语言和9种中文方言,具备音色设计、可控声音克隆等特性,还完全开源,商用就绪。
DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂大模型推理技术!
DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。
陶哲轩说:AI 辅助数学证明,已经成了日常操作
世界顶级数学家陶哲轩解决 Erdős 经典问题时,全流程用 AI 做助手,从证明草案到简化证明,再到形式化验证。整个流程为人类提出猜想、AI 暴力证明、人类简化优化、AI 辅助形式化验证。