「模型架构升级」共找到 9051 篇相关文章
AI圈最准的消息,都藏在这个小小的Web3网站里。
文章介绍了Web3平台Polymarket,它能提前预测AI模型发布日期等事件,准确率颇高。其玩法基于群体智慧,参与者用钱下注表达观点,价格反映事件发生概率,比KOL分析更靠谱。
AI版盗梦空间?Claude竟能察觉到自己被注入概念了
Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。
OpenAI最新开发者“全家桶”:Apps SDK、Agent Builder、ChatKit深度解读与实测
长假期间,OpenAI在2025 DevDay宣布开发者生态重大升级,引入“Apps in ChatGPT”及其SDK和AgentKit工具集。文章深度解读Apps SDK、Agent Builder、ChatKit,介绍功能、使用方法和体验,还提及OpenAI的AI大平台战略。
AI 项目总踩坑?小团队、渐进研讨带你找到正确打开方式
Cloud Native Summit 2025奥克兰大会探讨企业借Open Practice Library将协作模式转化成果。Andrea Magnorsky分享Byte - Sized Architecture方法,Ahilan Ponnusamy与Andreas Grabner介绍企业采用AI的迭代式框架,强调小规模持续研讨。
避免Claude Code 降智的一小招
Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。
vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存
EmbeddedLLM介绍vLLM新功能“休眠模式”,可在不重启服务时几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。
百度搜索变天了:怎么搜索你们定
百度 App 搜索框大改版,升级为智能框,支持多模态输入,降低使用门槛。还推出多项功能,如百看、智能创作、深度搜索等,接入 MCP 服务,推动产品能力多方面转变,探索新盈利模式。
Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!
近期Anthropic分享构建多智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用多步骤搜索动态查找信息。
故事式
作者李继刚在好友丁锐启发下尝试「故事式」Prompt,即塑造含「欲望」与「阻力」的动力场让模型生成回复,还给出如「字典疯子」「探索者」等多个故事式Prompt示例供读者体验。
AI重塑搜索:夸克“深度搜索”如何定义下一代信息入口|甲子光年
大模型发展推动搜索产品革新,“搜索”变“深度搜索”。夸克升级AI超级框发布“深度搜索”,即将推出“深度搜索Pro”。其“深度搜索”情商高,“深度搜索Pro”免费、快速、专业,夸克正打造AI全能助手。