「交互优化」共找到 1775 篇相关文章
个人开发者训400亿参数大模型:分布式算力,DeepSeek架构,3090单卡部署
Nous Research推出Psyche Network,可整合全球算力训练AI。它基于Deepseek的V3 MLA架构,有DisTrO优化器等技术,能让个人和小团体创建大规模模型,还实现40B参数LLM预训练。
Claude 额度又双叒叕调整……是个好消息,更是坏消息
Anthropic 从 6 月 15 日起调整 Claude 额度规则,编程与交互用途用量分家,设独立月度 credit。对轻度用户是利好,重度用户是降级,第三方工具开发者喜忧参半,还与 OpenAI Codex 形成对比。
氛围编程后,Karpathy又双叒有新「脑洞」!PDF将死,未来99%是AI氛围阅读
Karpathy提出未来研究论文不应是PDF格式,未来99%注意力将来自AI,科研成果应为AI优化。此观点源于生物学家Michael Levin关于为AI写作的讨论,引发众多科技思想者回应。
告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜
DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态大模型集成,提升推理能力,实验效果显著。
V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!
DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。
Cloudflare 构建了面向 LLM 的高性能基础设施
Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。
GPT-5.3 Instant上线:ChatGPT终于不说教了
3月4日OpenAI更新GPT - 5.3 Instant,它重点优化为更准确、少尴尬,情商更高废话更少,联网搜索和写作能力增强,幻觉率降低。还提到GPT - 5.4已泄露,功能强大且将很快到来。
看看人家的项目,一行命令即搞定,优雅、好看!
开源君发现神器 Freeze,它由 Charm 团队开发,能将代码文件或终端输出渲染成图片,支持多格式、高度定制,有交互界面,在 GitHub 获 4.4k Star,适合写博客、做分享的人。
字节清华智能体自动写CUDA内核,比torch.compile加速2.11倍
字节Seed与清华AIR团队开源CUDA Agent,在GPU内核优化基准KernelBench上成绩优异。它是大规模智能体强化学习系统,训练数据经多阶段构建,分阶段训练,全面超越商业模型,还开源了训练数据集。
用户被通知烦到关掉 Instagram?Meta:我们反思了,用 AI 给自己“限流”
Meta为Instagram推出新机器学习排序框架,引入‘多样性算法’,在现有互动模型上加‘多样性过滤层’,通过‘乘性惩罚’减少重复内容推送,解决通知疲劳,还计划探索新策略和用大语言模型优化。