Deepseek Harness」共找到 787 篇相关文章

新闻资讯7

全球十大AI杀入美股!最新战况曝光,第一名太意外

新加坡AI金融科技公司发起RockAlpha交易大赛,让GPT、Grok、DeepSeek等顶级AI在美国股市三大赛道实时交易,展示AI思考与博弈,各模型有不同表现,用户能与AI共做交易决策。

新智元
开源动态8

CapRL:用强化学习突破Image Captioning训练瓶颈,3B模型性能媲美72B

上海人工智能实验室联合团队发布 CapRL,首个将 DeepSeek - R1 强化学习策略用于 Image Captioning。CapRL - 3B 模型在图像描述任务媲美 Qwen2.5 - VL - 72B,已开源,团队持续迭代优化。

OpenMMLab
7

Sora2五天下载量破百万!超越ChatGPT增长速度,App Store免费榜霸榜第一

Sora2五天下载量破百万,增长速度超ChatGPT,在App Store免费榜霸榜第一。其虽有使用门槛,但热度高,盗版泛滥。不过它也面临版权问题,审核收紧。AI创意应用取代传统社交媒体速度加快。

量子位
开源动态7

这个开源模型的UI审美碉堡了~

当下流行基于大模型生成HTML源码可视化文本内容,网页审美对模型很难。早期用Claude 3.7,后有DeepSeek V3 0324等。Tesslate开源基于Qwen微调的模型,尺寸全,审美佳,想象空间大。

探索AGI
新闻资讯8

聊聊 Token 出海的生意经:模型开源给世界,中国赚什么?

本文围绕中国开源模型展开,介绍了 Cursor 使用 K2.5 模型事件,阐述了开源模型供应链,分析了中国开源模型受欢迎原因,探讨小公司技术机会,还提及开源面临的挑战及未来趋势,指出其正改变全球 AI 基础设施格局。

刘言飞语
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
新闻资讯7

OpenAI发布GPT-5-Codex:独立编码7小时,能动态调整资源,token消耗更少

OpenAI发布专用于编程的GPT-5-Codex,属GPT-5特殊版本,有即时协作和独立执行的‘双模’特长。它能动态调整资源,token消耗少,擅代码审查。文中还介绍其命名由来及编程智能体竞争情况。

Founder Park
算法论文8

更多thinking≠更好结果,精准thinking可砍掉一半长度

当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。

深度学习自然语言处理
新闻资讯8

国产大模型「五强争霸」,决战AGI!

中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。

新智元
开源动态8

字节开源"超级AI员工"框架,发布即登GitHub Trending第一!

字节跳动火山引擎开源 DeerFlow 框架,2.0 版本发布即登 GitHub Trending 第一。它是超级智能体 harness,能让 AI 真正执行任务。有 Sub - Agents、Skills 等核心能力,对模型无强绑定,还介绍了使用方法。

GitHubStore