训练问题」共找到 4879 篇相关文章

开源动态7

Kimi K2基于DeepSeek V3构建

从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。

AI寒武纪
新闻资讯7

Anthropic联创公开劝退套路码农!94%编程将被接管,去学点哲学吧

Anthropic联创Jack Clark在峰会上称大学生应避开「套路化编程」,未来需跨学科综合、分析思考能力。Anthropic雇哲学家训练Claude,工程师工作转向管理AI智能体,AI接管编程趋势明显。

新智元
开源动态7

这个项目让 Clawdbot 接入飞书机器人,附教程!

该项目解决 Clawdbot 官方不支持国内通信软件问题,提供飞书等国内 IM 平台与 ClawdBot AI Agent 的桥接服务,文中介绍前置要求、安装、使用、开发等内容,还给出项目地址和教程。

GitHubStore
新闻资讯8

Ilya Sutskever 最新毕业演讲:我们正处在人类史上最不寻常的时代,因为 AI 终将无所不能,你的未来无法逃避

Ilya Sutskever 在多伦多大学毕业演讲称,AI 终将无所不能,人类应接受现实,努力向前。他建议大家使用顶尖 AI 形成直觉,直面 AI 带来的挑战,关注并解决相关问题

宝玉AI
开源动态8

南京大学开源SteadyDancer模型实现完美动作迁移,首帧保留彻底解决身份漂移难题

南京大学、腾讯PCG与上海人工智能实验室联合推出SteadyDancer,这是首个基于Image-to-Video范式并严格实现首帧保留的开源人像动画框架,解决了传统方法身份漂移难题,在多方面表现优异。

AIGC开放社区
新闻资讯7

特斯拉Robotaxi首秀翻车!逆行急刹吓哭网友,半路抛客全程高能预警

特斯拉Robotaxi上线首日状况百出,如逆行、急刹、无视限速标志等。虽有惊艳表现,但问题引发关注,美国汽车安全监管机构已展开调查,若bug不修复或被召回。

新智元
算法论文8

SRO赋能Qwen-2.5-VL推理性能飙升16.8%

文本领域推理模型成就大,但多模态大型语言模型推理能力扩展遇阻,如冷启动初始化不足等。提出SRO三阶段训练框架,经测试,ReVisual - R1平均性能提升16.8%。

CourseAI
产品应用7

grok 4一图流

文章展示grok 4核心数据,涵盖训练成本、模型定价,还列举其在通用、专业、数学、推理、编程等能力测试中排名第一的成绩,不过实际水平还有待观察。

AI寒武纪
推荐文章8

Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础

著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。

机器之心
新闻资讯7

ICML 2025放榜!接收率26.9%,高分被拒,低分录用惹争议

第42届国际机器学习大会(ICML)2025放榜,接收率26.9%。文章汇总了被接收的优秀论文如MARS、ShadowKV等,以及有争议的论文,一些高分被拒、低分录用,评审存在矛盾与粗心问题,欢迎读者在评论区讨论。

机器之心