「环境模拟器」共找到 926 篇相关文章
Paddle OCR走到了尽头,Unlimited OCR一次读40 页
百度开源的Unlimited OCR把解码器里全部attention层换成R - SWA,模型只记128个token,能一次性读完40页文档。相比DeepSeek OCR,它在精度、速度上表现更优,训练成本低,适用范围广。
Claude Code 推出安全审计插件,边写代码边抓漏洞
Claude Code上线官方安全插件security - guidance,能在写代码时自动识别并修复安全漏洞。它分三层防线,覆盖多种漏洞类型,还支持自定义安全策略,安装方便,但只是辅助工具。
当我把 AI 变成一个"算法":Skill 工程化设计的心路历程
作者分享将 Agent 工程化设计的历程。指出 LLM 做 Agent 有痛点,引入 CLI 接管确定性任务和上下文管理,还设计了 Workflow 串联工具,实现自动扩展和无缝互转,最后做 workflow - creator 形成自洽闭环。
刚刚,Anthropic官方Harness被LangChain悄悄开源了~
上周,Anthropic发布官方Harness:Claude Managed Agents,但它闭源。LangChain则发布Deep Agents Deploy的Beta版本,是开源、模型无关的Agent框架,可用于生产环境,部署步骤被打包成一个命令。
去掉像素中介!上海交大让AI边看边想边画,用同一个“大脑”跨模态推理
上海交大等团队提出LatentUM架构,摒弃像素解码中介,在共享语义潜空间跨模态思考。它用MBAQ技术转化视觉特征,设计MoME架构,还能自我反思、规划路线、模拟世界演变,表现出色。
堆推理链全错了!林俊旸离职首曝:曾在阿里 Qwen 踩中一个“致命”技术误区
阿里千问技术负责人林俊旸离职后发声,复盘 Qwen 训练尝试,指出合并 thinking 和 Instruct 模式不理想。他认为大模型未来应从‘推理思维’走向‘智能体思维’,并阐述了智能体思维的特点和挑战。
AI的记忆问题解决了!最强记忆基准99%的准确率
Supermemory团队构建的实验性AI智能体流程,在LongMemEval基准测试中达近99%准确率。其技术摆脱传统限制,以新方式处理信息。ASMR创新数据摄取和检索管道,有两种回答流程,团队计划开源代码。
OpenClaw 3.24发布:彻底解决最重要的Skills安装障碍!
OpenClaw 3.24 发布,改动显著。Skills 安装更顺滑,系统自动检测依赖;控制台界面大改,侧边栏更易用;修复媒体文件访问漏洞;Microsoft Teams 支持升级;还修了多平台群聊 Bug,新增 API 端点,提升 RAG 兼容性。
微信龙虾只活2天:一次更新干崩全生态,OpenClaw 撞上 Vibe Coding 天花板
3月22日微信官宣推出支持接入OpenClaw的ClawBot插件,两天后OpenClaw更新,将插件生态系统迁移到官方ClawHub市场,引发诸多问题,如系统崩溃、插件失效等。此次事故暴露系统脆弱性,也为Vibe Coding发展敲响警钟。
最强开源搜索再升级,研究、预测能力实测超惊艳!
MiroMind团队发布新一代模型MiroThinker-1.7和MiroThinker-H1,定位为重型推理智能体。其研究能力强、推理可靠,还能生成网页报告。新版本升级显著,靠两项关键技术实现有效交互,且预测案例表现出色。