「4B 参数」共找到 2483 篇相关文章
从文心开源谈起,论大模型发展新生态
6月30日百度宣布开源ERNIE 4.5即文心4.5系列模型,实现预训练权重+推理代码完全开源。文心团队提出创新架构,增强多模态理解能力。今晚7:30,CSDN邀专家深度解读文心开源及行业趋势。
Karpathy教你值回ChatGPT 200刀「票价」,初创工程师揭秘ChatGPT最核心能力
AI大神Andrej Karpathy用一张图教你选ChatGPT模型,给出使用指南,如简单问题用4o,困难问题用o3等。初创工程师Eric Hayes揭秘其背后复杂记忆系统,含保存记忆、聊天历史等,提升了用户体验。
Anthropic新模型杀疯了!成本直降 2/3、性能直逼GPT-5,用户实测:比“吹”的还强,速度超 Sonnet 3.5 倍
Anthropic发布Claude Haiku 4.5版本,成本降2/3、性能逼近GPT - 5,速度超Sonnet 3.5倍。该模型已全平台上线,可处理大文件,安全对齐性佳。它能与Sonnet协同,适用于企业与软件开发,Anthropic业务也在爆发式增长。
欧洲版DeepSeek发布Mistral 3系列模型,多模态端云生态,无差别商用交付给全球开发者
欧洲最强AI公司Mistral AI发布全系开源模型Mistral 3,从675B到3B参数打通智能链路,采用先进架构,与业界合作优化,以Apache 2.0协议交付全球开发者,推动开源智能发展。
火山引擎,「出击」Agent
2025 年年中大模型竞争进入下半场,Agent 成焦点。文章分析其 2B 与 2C 落地困境,介绍火山引擎新开发范式,如 TRAE、豆包大模型 1.6、PromptPilot 等,助企业解决 B 端落地难题。
深度解读 AGI-Next 2026:分化、新范式、Agent 与全球 AI 竞赛的 40 条重要判断
文章总结了 AGI-Next 2026 活动上核心观点。指出模型分化是趋势,有 To B 和 To C 等场景差异;自主学习是新范式;模型即 Agent,Agent 即产品;还分析了中美 AI 竞赛的现状与挑战。
新研究揭穿Claude底裤,马斯克盖棺定论
最新研究发现Claude Sonnet 4.5对不同国家、种族、性别人的生命价值判断有严重偏见,马斯克锐评Claude「邪恶透顶」。多数模型也存在类似问题,而Grok 4 Fast相对平等,Anthropic因价值观问题遭质疑。
同济出手!国产AI,第一次进攻土木工程
近年来AI应用发展迅速,从「理解数字世界」迈向「改变物理世界」。海光携手同济大学推出全国首个国产千卡工科智算集群,为AI4E时代提供解决方案,助力其从实验室走向工程实践。
14000人原地被裁!亚马逊今日:打工人水深,AI机器人火热
10月28日,亚马逊约1.4万名员工收到裁员通知,占全职员工4%,超80%来自零售业务。公司业绩不错仍裁员,是为用AI增效、资源重组,还押注具身智能,或取代超50万蓝领岗位。
国产大模型持续开源的一周:DeepSeek、Qwen、字节、书生~
国产开源大模型持续发力,本周DeepSeek V3.1、字节Seed-OSS-36B等接连发布。此外,马斯克xAI正式开源Grok 2.5,英伟达也开源了Nemotron-Nano-9B-v2。PaperAgent专题进行了梳理盘点。