「模型使用经验」共找到 8843 篇相关文章
Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌全参数微调
Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。
Claude Code + Kimi K2全栈开发教程,1小时上线「"丑咪"挑战赛」!
作者分享用Cursor + Claude code + Kimi K2开发「丑咪挑战赛」全栈项目的体验,介绍组合优势、接入教程、前端测试案例和使用技巧,认为Kimi K2在agent和coding能力上表现不错,适合作为Coding模型。
一句“Hi”,80$蒸发!O3-Pro:地表最强,也最“坑”的AI!
昨晚ChatGPT宕机,OpenAI 2折甩卖o3模型并发布o3 Pro。o3 Pro编程能力强,达全球top150程序员水准。官方称甩卖的o3是原版但推理快近40%。o3使用成本高,还需足够上下文。
DeepSeek R1 的小更新,却大有深意?
5月28日,DeepSeek低调宣布R1模型小版本试升级,API接口和使用方式不变,但未公布具体更新内容。从用户反馈看,语义理解、逻辑推理等能力提升,实测表现出色。此次升级或有安全、产品路线等考量。
RL成本降幅超90%!Meta提出Agent训练新范式DreamGym
传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。
EMNLP 2025 | 动态压缩CoT推理新方法LightThinker来了
随着AI发展,大语言模型处理复杂推理任务能力提升,但推理产生大量中间步骤和文本,拖慢计算速度、增加资源压力。研究者提出LightThinker,模仿人类思考模式,动态压缩推理步骤,削减tokens数量,降低成本。
碾压小扎!22岁成亿万富翁,2025年AI造富速度刷新人类认知
2025年AI成超级造富机,将50多位创始人送入亿万富翁俱乐部。从大模型到应用层,AI渗透生活。巨额融资不断,巨头砸钱建基建,人才争夺激烈,多模态初创公司也受青睐,职场AI使用比例上升。
刚刚,谷歌放出Nano Banana六大正宗Prompt玩法,手残党速来
谷歌 Nano Banana 被网友玩出花样,背后是巧妙提示词的功劳。刚刚谷歌官方公布了该模型六个文本转图像提示,可进行文本生成图像等操作,还给出对应提示模板,不过使用中也存在一些问题。
xAI 全员大会实录:递归自我改进、5000 万视频/天、月球上的质量驱动器
本文是 xAI 全员大会实录,覆盖公司核心业务,如重组为四大方向、编程模型递归自我改进、Imagine 视频生成使用量等,还提及 X App 增长、太空愿景等,也指出公司存在高层流失、项目落地不明等问题。
“美国大豆包”Gemini翻身:输出速度碾压同行、智能水平重回第一梯队
过去 Gemini 被吐槽,如今 Google 推出 Gemini 3.8 Flash,六周内第三款 Flash、四个月内第四次更新。新模型成绩佳,输出快,成本低,智能体评测进步大,从经济型选项成生产主力,但实际表现待检验。