「编程社区」共找到 1476 篇相关文章
模型汤新做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷新SoTA!
大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。
今天,好像见证了属于SD时代的消亡。
liblib宣布升级到2.0,作为国内最大SD生态开源社区,其转型宣告SD时代落幕。曾几何时,SD让普通人感受AI绘图魔力,如今技术迭代,AI绘图门槛降低,新模型受大众青睐。
Google封神,计算机视觉的GPT3时刻来了!
Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。
Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录
Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
6月10日美团推出首款AI Coding Agent产品NoCode。美团基础研发平台工程效率负责人程大同在访谈中解答诸多问题,如模型性能优化、产品竞争力、用户使用难点等,还提及产品未来规划和对行业发展的看法。
腾讯AI Lab 提出解耦推理新框架,破解IMO 数学难题
腾讯AI Lab梁振文和宋林峰提出“解耦推理与证明”框架,解决当前大语言模型在自动化定理证明领域“思考”与“证明”能力失衡问题,成功解决5道IMO难题并开源成果。
OpenAI最强对手出现!马斯克发布Grok-4,性能碾压Claude 4两倍!
半小时前马斯克发布Grok - 4,虽Grok3.5跳票、直播迟到被吐槽,但它训练量和算力投入大。在多项基准测试中碾压Claude Opus 4,还具备原生工具调用等能力,xAI目标是让其更快更智能。
从输入指令到代码落地:Cline AI 源码浅析
文章从源码角度剖析 Cline AI 将自然语言指令转化为编程任务的过程,包括启动调试、前端输入、主进程处理、任务初始化、构建提示、模型请求等环节,指出核心是 prompt 组装和 tools 调用。
谷歌又来砸饭碗!免费AI Agent发布,程序员狂喜
谷歌发布免费开源的AI Agent——Gemini CLI,可在电脑终端运行。免费额度高,用个人谷歌账号登录就能用Gemini 2.5 Pro,还有大上下文窗口和高请求额度。它能力不止编码,功能强大且易上手。
最新发现!每参数3.6比特,语言模型最多能记住这么多
Meta、DeepMind等团队研究语言模型记忆容量,提出新方法估计模型对数据点的‘了解’程度,发现GPT系列模型约每个参数3.6比特,还提出模型容量等相关定律,激发社区多方面思考。