「token使用」共找到 1866 篇相关文章
Anthropic自研AI面试官,深度访谈1250名职场人,揭示AI在工作中的真实影响
Anthropic发布Anthropic Interviewer工具,对1250名专业人士访谈。结果显示,人们对AI在工作中的作用普遍乐观但局部悲观,不同职业群体对AI态度和使用情况有差异,研究数据将公开。
冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世
微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。
Windsurf惊魂96小时!AI闪电并购战:谷歌天价挖人,Cognition逆袭接盘
7月,谷歌以翻倍薪资和24亿美金许可协议挖走Windsurf 40多位顶尖人才。周一,Cognition宣布收购其剩余资产和200来号员工。此前OpenAI收购谈崩,Windsurf还遇模型使用问题。
打破传统游戏逻辑!Google | 提出Concordia ,通过Mutil-Agent构建游戏引擎!
Google DeepMind和多伦多大学研究人员提出Concordia软件库,用AI驱动智能体担任GM,基于「实体 - 组件」架构,让工程师和设计师分工,可灵活构建复杂游戏场景,还支持不同交互动态和多种使用动机。
大模型系统提示词逆向(1)—— ChatGPT
文章介绍大模型系统提示词逆向原理,利用‘认知冲突’让AI意外‘泄密’。还给出逆向提示词示例,并展示了ChatGPT系统提示词原文及翻译,包含其角色设定、工具使用规则等内容。
ICML 2025 Spotlight|华为诺亚提出端侧大模型新架构MoLE,内存搬运代价降低1000倍
华为诺亚和北大研究人员提出端侧大模型新架构MoLE。它解决传统MoE显存开销大、传输延迟高问题,推理时将专家输入改embedding token,用查找表替代矩阵运算,实验显示性能与MoE相当,大幅降推理延迟。
比Gemini 3记得更多,谷歌新框架将上下文记忆干到了200万!
Google在NeurlPS2025大会推出结合RNN与Transformer的全新架构Titans,能扩展到超200万个token上下文。背后涉及Titans和MIRAS两篇论文,共同推进测试时记忆概念,实验显示新架构性能出色。
GitHub MCP 注册中心提供了一个发现和部署 MCP 服务器的中心枢纽
GitHub 推出 MCP 注册中心,旨在帮开发者发现和使用 AI 工具,简化 AI agent 连外部工具的过程。它列出 40 多个 MCP 服务器,还展示受欢迎程度。此外,Docker、Postman 等也有相关目录。
不是,微信视频号里现在也能召唤腾讯元宝了?。。。
现在可在视频号评论区用@召唤腾讯元宝。测试发现,它能总结视频内容、提取金句、总结脚本,还能总结菜谱。添加好友后就能使用,未来评论区或成共创聚集地。
效果非常不错!阿里昨开源图形海报生成模型Qwen-Image
阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。