「形式化验证系统」共找到 2421 篇相关文章
大模型被确诊「视觉文盲」!多校联合提出MILO,为它植入空间想象力
空间推理是多模态大语言模型(MLLMs)应用关键挑战,当前‘语言描述式调优’让模型成‘视觉文盲’。多校联合提出MILO范式,结合视觉生成反馈与语言调优,还构建GeoGen数据集,经五大任务验证其有效。
Claude Code 推出插件功能
Anthropic宣布Claude Code支持插件系统,开发者用一条命令就能安装定制化工具集合。插件把斜杠命令等打包,可按需开关。使用简单,已有多种插件,还能自行创建和托管,插件功能或成其生态重要进化。
不愁了!开源智能体Paper2Poster「一键生成」学术海报
2025年5月,滑铁卢大学等团队发布Paper2Poster系统,用大模型将论文自动生海报。它提出PosterAgent多智能体方法,分解析、规划、绘制优化三阶段,生成效果好且开源,不过也存在效率和创意不足问题。
1篇长文 = N张小红书爆款图?!Gemini 2.5 Pro 这效率,我跪了!
作者作为小红书小号主,苦于长文转图难,用Gemini 2.5 Pro Preview 05 - 06实现了一键转换。文章分享提示词结构、使用方法、修改方式,还介绍用AI调风格,指出系统有生成不稳定和下载问题。
DeepSeek 把 Harness 开源了:模型、工具、Agent Loop 全是插件
8月13日,DeepSeek面向全球开发者开放DeepSeek Harness开发者预览版v0.1并开源代码。其特色是一切皆插件,提供四种运行模式,内置多Agent系统,有创新但编排范式未突破,还采用仅追加的会话日志。
GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!
GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器可自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。
清华首提通用大模型滤波方法,实现零样本状态估计|NeurIPS'25
清华大学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入大语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型。
甲骨文推出全球最大AI超算,作为OpenAI「星际之门」算力核心
甲骨文于2025年AI World大会发布全球最大云端AI超算「OCI Zettascale10」,成OpenAI「星际之门」算力核心。其独创Acceleron RoCE网络提升性能与能效,但16 ZFLOPS算力待验证,甲骨文还推积分计划吸引客户。
吴恩达Agentic AI新课:手把手教你搭建Agent工作流,GPT-3.5反杀GPT-4就顺手的事
吴恩达新课聚焦Agentic AI,将开发沉淀为反思、工具、规划与协作四大设计模式,强调评估与误差分析能力。课程介绍拆解任务、构建工作流方法,还分享实用技巧,让AI系统持续进化。
DeepSeek-R1登顶Nature,8位专家严审通过, 大模型「交卷时刻」来了
近日,DeepSeek - R1登上Nature封面,打破主流大模型未经过独立同行评审惯例。同行评审可理清模型机制,提升透明度与可信度,还能避免‘刷榜’‘自评’,虽有公司担心泄密,但它是验证成果的必要程序。