标准分」共找到 938 篇相关文章

新闻资讯8

梁文锋突袭马斯克!DeepSeek V4 Pro对战Grok 4.6,首测夯爆了

梁文锋凌晨发布DeepSeek V4 Pro正式版,马斯克推出Grok 4.6,二者在多项评测中表现出色,直逼OpenAI和Anthropic顶尖模型,还降低了前沿智能价格。首测中,二者在真实任务场难伯仲。

新智元
推荐文章7

AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?

《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 享理解代码方法。

特工宇宙
推荐文章7

我把斯坦福最火的一门课,做成了Prompt来帮我设计人生。

作者受《人生设计课》启发,将课程内容做成Prompt借助Claude辅助设计人生。此Prompt四阶段,经多轮对话生成蓝图,含现状、问题、计划等,还提及原型行动和失败免疫,多位同事使用后有新感悟。

数字生命卡兹克
产品应用7

Anthropic发布重大更新推出CC进化版Claude Tag,Karpathy:LLM第三次交互革命来了

Anthropic推出Claude Tag,是Claude Code进化版,更主动适合团队协作。有多人协作、持续学习等四大优势,权限频道隔离。Claude Enterprise和Team用户可在beta阶段用,Andrej Karpathy称是LLM第三次交互革命。

AI寒武纪
开源动态8

DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude

DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练三阶段,测试中表现出色,也存在局限。

AIGC开放社区
产品应用8

访谈|Codex 团队如何用自己的产品构建产品——整个 Spec 只有 10 个要点

OpenAI Codex 团队产品规格文档极简,仅 10 个要点。团队运作如‘海盗船’,规划只做近期和远期,不做中期。Codex App 诞生源于模型能力提升,团队以 power user 为导向设计产品,还谈到 PM 角色转变和招聘标准

宝玉AI
新闻资讯8

紧急警告:LiteLLM PyPI 包被植入恶意代码,请停止更新

月下载量9700万的Python库LiteLLM被黑客植入恶意代码,36%云环境或受影响。恶意代码三阶段,可窃取敏感信息。攻击源于供应链漏洞,黑客利用被盗凭证发布恶意版本。官方已采取措施,建议用户自查。

AGI Hunt
新闻资讯8

更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜

具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部模型,揭示不同技术路线能力边界,为产业发展提供基础。

机器之心
算法论文8

王兴兴署名,宇树机器人春晚之后又进化了:单个策略就能学习各种极限动作

春晚上,宇树机器人展现高动态、高协同的全自主集群控制技术。现在,多机构提出 OmniXtreme 通用策略,可执行各种极限动作。该框架两阶段,经测试在仿真和现实中表现出色,打破了泛化壁垒。

机器之心
开源动态7

DeepSeek新模型DeepSeek-V4-Lite-285B测试曝光:“大海捞针”召回率100%

社区消息显示DeepSeek正测试新模型DeepSeek - V4 - Lite - 285B,用OpenAI MRCR 8 - pin标准考察超长上下文信息检索能力。测试结果优异,但‘大海捞针’法或被DSA作弊,实际效果存疑,社区高度关注其进展。

AI工程化