「Grok大模型」共找到 9398 篇相关文章
刚刚,GPT-6代号再泄露!或将周四见
据传GPT - 6本周将发布,OpenAI「义父」爆料Codex接入最强Astra模型,其内部代号「mewfour」泄露。Astra内部版已解决多个数学难题,成本仅约2000美元,还或达网络安全最高能力阈值,可能开启多智能体原生时代。
DeepSeek V3.2爆火,Agentic性能暴涨40%解密
文章解密了DeepSeek V3.2 Agentic性能暴涨40%的原因,即采用交错思维链机制。还对比了其与早期ReAct范式,介绍其效果、原理,以及MiniMax为落地该机制做的工作,最后提到多家模型达成技术共识。
给野马套上缰绳:Agent Harness 工程实践 ——从范式理论到钉钉AI招聘的真实落地
本文围绕 Agent Harness 工程实践展开,指出瓶颈在‘装’好模型而非模型本身。介绍 Agent 公式、范式跃迁、四条铁律、工程模式,以悟空 AI 招聘为例说明落地,还分析行业标杆、未来趋势,给出心法。
Claude强到不敢发的Mythos,被质疑用了字节Seed技术
Claude最强“神话”模型Mythos引发猜测,或用了字节Seed技术。社区热议其是否采用循环语言模型架构,关键线索来自Anthropic测试数据,在图搜索测试中Mythos优势明显,还有其他线索指向循环架构。
龙虾连Gemma 4,只需三步,谷歌官方教程出炉,不再花钱买token
谷歌官方发布教程,教大家分三步将 Gemma 4 和龙虾(OpenClaw)连接。有人认为此流程清晰直接,让本地跑 Agent 变得简单。不过 Gemma 4 与顶尖模型有差距,且小模型安全性存疑。
Anthropic最新2026趋势报告:人类最大一次编程革命势不可挡
Anthropic发布《2026年智能体编码趋势报告》,指出编程规则改变,任何人都能成开发者。报告给出8大趋势,如软件开发生命周期剧变、智能体能力提升等,还给出2026年组织需关注的4大领域。
图像编辑缺训练数据?直接从视频中取材,仅用1%训练数据实现近SOTA效果
百度研究人员提出将图像编辑视为退化的时间过程,Video4Edit利用视频预训练模型知识迁移,仅用主流编辑模型约1%监督数据,在图像编辑任务达近SOTA效果,解决数据稀缺与权衡难题。
AI+直播的新玩法! StreamDiffusionV2让创意零延迟
生成模型改变直播行业,但此前模型难保证时间一致性、有延迟等问题。加利福尼亚大学推出StreamDiffusionV2,通过智能调度和缓存机制优化,支持多GPU并行,可灵活调画质和延迟,实现实时直播。
HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴
蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。
本地部署Qwen 3.8 27B,要用什么配置
Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。