「Deepseek V4 Pro」共找到 1344 篇相关文章
李飞飞发起机器人家务挑战赛!老黄第一时间批钱赞助
李飞飞团队发起、英伟达赞助的首届BEHAVIOR家务挑战赛启动,参赛者用星海图R1 Pro在虚拟家庭环境完成50项家务。受ImageNet启发,该赛旨在解决机器人学习痛点,推动具身智能发展。
从后训练回到预训练,LLM+RL 的潜力兑现有有机会走更远吗?
RL与LLM结合是重要技术方向,应用从后训练延伸至预训练。虽看似为LLM+RL带来希望,但RL本身有局限。微软等提出的RPT有潜力,不过训练语料等未广泛验证,且需大量计算资源。
更多thinking≠更好结果,精准thinking可砍掉一半长度
当前大模型如GPT - 4、DeepSeek推理又长又啰嗦,论文发现其在简单题目上过度推理。作者提出‘无效思考’概念,还给出解决原则,用LC - R1方法训练,效果显著,揭示精准思考才是王道。
谷歌AI核爆:升级全系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?
北京时间5月21日凌晨,谷歌在2025 I/O大会发布众多更新。模型层面,为Gemini 2.5 Pro引入新推理模型和2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3,编码助手Jules公测等。
国产大模型「五强争霸」,决战AGI!
中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元
华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现超 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单超亿元,进入规模化金融场景验证阶段。
Vercel 发布新语言 Zero:代码不是写给人看的,而是写给 AI 的
Vercel Labs 发布实验性系统编程语言 Zero,定位是速度快、体积小且便于智能体使用修复。Zero 有工具链契约等特色,v0.3.0 有重大转变,不过在 Hacker News 上遭部分质疑。
2.4K Star!小米最新开源!覆盖600+语种的语音克隆TTS,40倍实时合成速度!
小米k2 - fsa团队开源OmniVoice,这是支持600 + 语种的零样本语音克隆TTS模型,性能超ElevenLabs v2和MiniMax等标杆,RTF低至0.025,合成速度快40倍,还支持声音设计等功能。
就问 OpenClaw 还能不能更新了,我的微信 ClawBot 咋办?
OpenClaw升级到V2026.3.22后,IM通道插件崩溃,用户无法通过微信等使用。开发者称是为抵御攻击,但规则太严。2026.3.23修复部分问题,后续提供更新步骤,还介绍应用场景。
如果你还不知道龙虾是什么,可以先试试 MaxClaw
去年开源模型 DeepSeek R1 火爆,今年个人 AI 助手 OpenClaw 成焦点。OpenClaw 在 GitHub 获大量 Star,MiniMax 基于它推出的 MaxClaw 是云端 AI 助手,功能多、易使用,在个人和企业场景都有大作用。