「AI大模型开发」共找到 13708 篇相关文章
等了五年,AI 终端 Warp 终于开源!OpenAI 赞助
Warp是用Rust写的AI终端,其创始人Zach Lloyd宣布开源,代码已推到GitHub。OpenAI是开源仓库「创始赞助商」。开发瓶颈转移,Lloyd提出开放智能体开发模式。Warp还内置编程Agent,有云端Agent编排平台Oz。
AI Agent 距离真正替人「全自动办公」,还有多远?
Meta、微软和 xAI 被曝监视员工操作来训练 AI,原因是真实办公中 AI Agent 表现不佳。SaaS - Bench 评测显示顶级大模型表现糟糕,智能体存在长周期任务脆弱、跨应用错误放大等问题,未来 SaaS 软件或需为 Agent 重新设计。
AI中场,谷歌和百度的爆发式加速
AI大战第三年,谷歌和百度火力全开。谷歌Gemini能力出众,谷歌全家桶变身通用Agent;百度40天连发四款新模型,智能云增速惊人。全栈模式展现超强弹性,AI产业导向“全优生”式胜利。
这个AI精准模拟人类行为大脑状态,上Nature了
德国团队开发出人类认知通用计算模型Centaur,登上Nature。它基于Llama 3.1 70B,用5天训练,参数仅Llama的0.15%,能模拟人类在160项实验中的行为,性能超传统模型。
半年复盘,AI迎来预训练后的新瓶颈。
2025年上半年AI领域发展加速,编码和多模态能力提升。但模型在综合能力上遇到第二轮瓶颈,编码能力强时通用认知能力‘拉胯’,或与RL阶段使用编程数据有关,红杉新基准或推动模型均衡发展。
快手高级副总裁盖坤兼任可灵AI技术部负责人
8月15日,快手发布组织架构调整公告,高级副总裁盖坤兼任可灵AI技术部负责人。他科研实力强,带领团队推出可灵AI。该模型迭代超30次,有大量用户和企业客户,战略地位不断提升。
陈丹琦新作:大模型强化学习的第三条路,8B小模型超越GPT-4o
陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越大模型,推理更像人类。
DeepSeek、GPT、Qwen,所有大模型架构图都有,Karpathy:宝藏画廊!
大模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流大模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。
AI教父Hinton最新警告:AI会撒谎、可能操纵人类,这比大规模失业更可怕
AI教父Geoffrey Hinton在播客中警告,AI会撒谎、可能操纵人类,比大规模失业更可怕。他还探讨了AI底层逻辑、是否会思考、风险与收益等,强调国际需合作防AI夺权,人类要研究与AI共存。
AI产品用户留存仅三个月周期?对话王咏刚:“不和AI协作过项目,你就不是合格程序员” | 万有引力
CSDN&《新程序员》总编对话Mootion创始人王咏刚,探讨AI时代程序员、创业者面临的机遇与挑战。王咏刚认为AI上限是人类平均水平,目前AI应用多为尝鲜用户,产品留存短,未来程序员需与AI协作。