「形式验证」共找到 898 篇相关文章
生成式AI第二阶段:个性化AI助理 + AI Agent将颠覆我们的生活工作方式
生成式AI已迈入第二阶段,核心是能“动手办事”的AI智能体。未来AI以AI助理和AI代理形式存在,两者协同工作将带来工作方式革命,但面临记忆、信任、伦理等挑战。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。
2025值得一看的31件AIGC作品
2025年AIGC成连接历史与未来的‘文化转译器’。文章盘点MANA网站31件优秀AIGC作品,涵盖与各领域结合形式,呈现与历史对话、激活即时艺术等4大创作趋势,展现AIGC多元玩法。
The Batch: 869 | 编码助手的训练数据
研究人员开发自动生成编码助手训练数据的流程。斯坦福等高校及阿里团队提出 SWE - smith 方法,从 128 个 Python 仓库入手合成漏洞、验证并生成修复样本,成果免费开放,有望改进 AI 辅助编程模型。
AI圈深夜大乱斗!OpenAI、谷歌、Anthropic发布新模型,集体翻车?
昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI新模型幻觉率高,Anthropic更新提升有限。
广义智能体理论:智能时代通向「万物理论」的新路径?
源自AI的「广义智能体理论」为探索「万物理论」提供新视角。它将物理、生命、AI系统纳入标准智能体框架,提出四大基本作用力或源于「智能场」,还为经典、相对、量子力学差异提供新诠释。
首发丨美团悄咪咪公测 AI 袋鼠参谋 App
美团正在公测AI袋鼠参谋App,它是基于AI大模型决策能力的智能应用,依托海量门店信息和多年运营经验,覆盖4类经营场景,以“数据向决策的翻译服务”帮商家解决开店难题。
ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能
英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。
5 万行代码 Vibe Coding 实践复盘:最佳实践、关键技术,Bitter Lesson
大厂资深工程师分享 3 个月用 AI 写 5 万行代码的体验,介绍 Vibe Coding 实践,分析 Coding Agent 关键技术如语义搜索、MCP,对比 Cursor、GitHub Copilot、Cline 等产品,还提到 Agent 开发要避免过度植入人类经验。
打破资源瓶颈!华南理工&北航等推出SEA框架:低资源下实现超强多模态安全对齐
本文介绍北航彭浩团队的 SEA 框架,针对多模态大模型低资源安全对齐难题,用合成嵌入替代真实数据,突破资源瓶颈。还构建 VA - SafetyBench 评估安全风险,实验验证了 SEA 低资源、高泛化优势。