「测试时扩展」共找到 2646 篇相关文章
ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练
在检索增强生成系统中,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。
360 如何用 AutoMQ 解决千亿级 Kafka 冷读难题
360 集团作为互联网安全公司,业务数据规模膨胀,Kafka 集群运维难题凸显。AutoMQ 存算分离等特性适配 360 需求,360 验证其性能后用于日志检索平台,解决冷读难题,未来将推广到更多业务线。
搞不懂Skills?看看Claude Code内部工程师们是怎么玩的
文章来自Anthropic的Claude Code团队工程师,介绍了Claude Code中Skills功能。阐述Skills定义、类型,给出制作技巧,如避免陈述显而易见内容、构建陷阱部分等,还提及分发、管理、组合及衡量效果的方法。
不只OpenClaw,这个app让你同时拥有龙虾和云手机
作者在OpenClaw主题直播中翻车,后发现RedClaw app可免配置免费体验OpenClaw。它提供云手机和AI,能突破移动端数据孤岛。作者测了3个场景,虽有不足,但认为方向正确,值得关注。
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
如何定义“人味儿”?——HeartBench评测体系建设实践
在大模型竞争格局生变,情感智能评测缺失的背景下,作者团队发布聚焦AI拟人化的中文评测体系HeartBench,介绍其设计、评估方式、迭代过程等,还沉淀了评测体系构建方法论及专家标注管理思考。
我复刻了 Claude 刚发布的生成式 UI 交互!
Anthropic在Claude上线基于生成式UI的新交互,作者复刻该功能到Code Pilot。介绍其多种玩法,如数据分析、制作小工具等,还阐述实现过程与体验打磨细节,保证生成式UI视觉稳定。
Claude 新增交互式图表和示意图,免费能用
Claude 新增交互式图表和示意图功能,付费与免费用户均可在聊天中直接生成。通过虚构建筑系学生 Andrea 的使用场景展示,如职业探索卡片、结构力学荷载图等,将工具嵌入成长故事线。
能导出 PSD 的 AI 设计工具,出现了
国内 Seede AI 团队发布海外新产品,无需写咒语,填文案信息就能让 AI 搞定排版等。它生成可编辑源文件,适合有内容但不会设计的人,还支持多格式导出,不过不擅长创意生图。
OpenAI史上最快模型降临,每秒1000Token!代码从此「炸出来」
OpenAI发布GPT-5.3-Codex-Spark,它是专为实时编程设计的超高速模型,生成速度超每秒1000个token,联手Cerebras硬件,重写底座提升性能,在多项测试表现强,ChatGPT Pro用户可尝鲜。