「设计领域Agent」共找到 5181 篇相关文章

产品应用8

刚刚,Claude 5.1 发布!全球最强模型来了

Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1面向普通用户等,Mythos 5.1面向高风险领域伙伴。Fable 5.1性能优、价格低,在多测试中表现提升,还能用于科研,且安全防护机制升级。

机器之心
新闻资讯8

突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达

OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在多模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。

机器之心
开源动态8

本地Opus你要不要!Qwen3.8-27B开源

阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能超Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent、多模态跑分表现出色。

AIGC开放社区
推荐文章7

无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金预算?

本文围绕美国数据市场展开,分析了数据赛道的投资判断、公司增长难题、需求结构、最新趋势等。指出数据虽重要,但外部数据公司份额难线性外推;真实世界数据成新热点,各细分领域格局和投资方向不同。

海外独角兽
新闻资讯7

Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车

Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。

AI科技评论
新闻资讯7

Sonnet 5 翻车!同性能价差最高 56倍,海外巨头为何复刻不出 DeepSeek?

Anthropic发布Claude Sonnet 5,官方称补足了Agent能力,价格优惠,但开发者反应不佳。Sonnet 5因tokenizer换代,实际使用成本更高,且比同类模型贵。与之相比,DeepSeek V4 Pro便宜很多,其靠技术实现低价,海外厂商难以复刻。

鲸选AI
产品应用8

豆包 2.1 Pro:属于普通人的代码能力

作者分享用AI写代码的经历,指出豆包2.1 Pro强化Coding Agent端到端交付能力,成本低。还展示用它做的多个案例,如歇后语扭蛋机、文件整理工具等,认为其能解决日常问题,降低Coding门槛。

刘言飞语
新闻资讯7

三星按下一场史上最长罢工,但揭下了AI时代贫富差距的遮羞布

三星员工因薪资分配问题拟罢工,后达成临时协议,但其他业务部门不满。AI 推动 HBM 需求暴涨,其市场被少数厂商垄断,技术演进依赖多领域突破。国产存储厂商有机会借供不应求切入市场,长鑫和长江存储传 IPO 进展。

InfoQ
产品应用7

【翻译】在 Codex 中使用 Goals:长时间工作的持久目标

文章介绍 Codex 中的 Goals,它是持久目标,能让线程跨多轮对话朝明确结果推进。阐述了 Goals 与普通 prompts 的区别、编写方法、活跃后的变化、设计方式及适用场景等,还通过案例展示其在研究任务中的应用。

GiantPandaLLM
开源动态8

Anthropic开源认知对齐MSM

大模型对齐、安全问题是行业大事,Anthropic开源的MSM对齐方法,能将Qwen3 - 32B的agent错位率大幅降低。它先给模型讲规则逻辑再微调,控制精度高,还研究了最佳实践,将改变大模型对齐流程。

CourseAI