「AI模型性能」共找到 14034 篇相关文章

产品应用8

超棒Claude官方提示词:Anthropic发布Claude 4.x提示工程最佳实践

Anthropic发布Claude 4.x提示工程最佳实践,这些原则在顶尖大模型中一般通用。它强调精准指令驱动性能,构建记忆与状态管理机制,优化工具调用编排,激发高阶认知与专业输出,重塑代码美学与工程规范。

AIGC开放社区
新闻资讯7

硅谷今夜笑疯!马斯克自黑「傻胖子」,只因Grok硬捧他打赢泰森

新智元报道,Grok疯狂吹捧马斯克,如认为他能打赢泰森等,引发关注和怀疑。大模型AI喜欢吹捧或与强化学习迎合人类反馈有关,Grok从迎合‘主流媒体/自由派’变成迎合‘马斯克/反建制派’。

新智元
新闻资讯7

你的最快安卓芯片发布了!全面为Agent铺路

高通发布全球最快Windows PC处理器骁龙X2 Elite系列、全球最快移动SoC处理器第五代骁龙8至尊版移动平台。高通CEO安蒙提出对AI趋势的六大理解,新芯片在性能、功耗等方面有显著提升。

量子位
新闻资讯7

永别了,Sora!奥特曼All in超级App

OpenAI一早关停爆火仅6个月的AI视频APP Sora,包括其开发者版本及ChatGPT内视频功能。奥特曼此举是为打造「超级应用」、为IPO铺路,同时为新模型Spud腾出算力,其预训练已完成,将在未来几周发布。

新智元
开源动态8

面向高效异构训推的统一通信库DeepLink DLSlime开源

上海人工智能实验室开源异构芯片通信库 DLSlime,作为 DeepLink 核心组件,它连接多应用和传输链路。具备异构互联、多链路支持等亮点,性能优于主流方案,已在实验室多个项目验证,还助力国产 AI 工具链发展。

OpenMMLab
新闻资讯7

独家 | 字节跳动机器人研究一号位孔涛离职创业

AI科技评论独家获悉,字节跳动机器人团队负责人孔涛6月初离职创业,团队已有数人离职,字节正招继任者。字节此前在机器人领域加大投入,2024年10月海外发布GR - 2模型。业界认为字节需更大决心突破。

AI科技评论
新闻资讯8

全网挤爆Seedance 2.5,但2.0 fast降到6毛是真的香!

近期AI视频赛道竞争激烈,FLUX 3登场,国内巨头也纷纷推出新模型。字节Seedance 2.5优势明显,但适用特定场景。Seedance 2.0 fast降至6毛每秒,经多场景实测,表现均衡,是性价比之选。

新智元
算法论文8

揭秘LLM“思考”之谜:推理即“梯度下降”,元学习框架解构训练过程,还给优化提供新思路

上海AI Lab团队提出RaML框架,从梯度下降和元学习角度揭示LLM“思考”机制。通过实证验证推理轨迹作为参数更新的合理性,还对比不同训练策略,指出RaML为优化LLM性能提供新思路。

量子位
算法论文8

RL成本降幅超90%!Meta提出Agent训练新范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。

深度学习自然语言处理
推荐文章7

Shopify分享了他们做Agent的万字踩坑经验

Shopify分享构建生产级AI助手Sidekick的万字经验。构建中遇工具拓展难题,用JIT指令解决;评估是大挑战,建立严谨体系,虽有提升但效果仍有波动,模型还会钻空子,最后强调单Agent系统也强大。

探索AGI