「编程能力评估」共找到 4471 篇相关文章
刚刚,美团推出 136 亿参数视频生成模型
美团推出 136 亿参数视频生成基础模型 LongCat-Video,采用 MIT 开源协议。该模型覆盖文本、图像生成视频及视频续写三类任务,能生成分钟级长视频。效率高,评测数据表现佳,安装和运行简便,引网友惊叹。
Nature重磅研究:大模型让你变得更聪明还是更笨了?创造力增强还是扼杀了?
《自然》研究表明,大语言模型对创造力的影响取决于任务。简单任务中,它像灵感助推器,分担认知负荷;复杂任务里,易致‘创意固化’,长期依赖还可能使大脑‘变懒’。需按需调节使用。
WebAssembly 3.0 发布,64 位内存、垃圾回收全都有,先别激动,组件模型还没做完!
WebAssembly 3.0 发布,有 64 位内存、垃圾回收等特性,但备受期待的组件模型未完成。虽未迎来‘Docker 时刻’,但服务器端生态有进展,不少平台已实现‘类组件’能力。
直播预约 | LightMem:面向大模型的轻量化可插拔记忆系统
本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、可扩展记忆组件。
OpenAI 即将发布 Agent Builder,类似扣子、Dify、n8n
据外网爆料,OpenAI 即将于 10 月 6 日 DevDay 发布 Agent Builder,它是工作流自动化工具,有拖拽式画布,能构建 Agent 工作流。对用 OpenAI API 的开发者等是福音,将延伸其平台能力。
可能是目前效果最好的开源生图模型,混元生图3.0来了
腾讯混元发布并开源原生多模态生图模型混元图像3.0,参数规模80B,是参数量最大的开源生图模型,也是首个开源工业级原生多模态生图模型,效果对标业界头部闭源模型。文中介绍其技术方案、测评效果等。
小模型才是 Agent 的未来?这篇立场文把话挑明了
AI Agent浪潮来袭,主流用LLM构建,但英伟达和佐治亚理工学院研究人员论文指出,多数Agent场景中,小语言模型(SLM)已足够强、更好管、更省钱,还给出迁移清单、避坑建议和参考系统形态。
AI开始学会合作?!实测4大多Agent体=10个打工人
Agent热潮进入多智能体时代,多款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出多Agent正推动大模型向“协作式智能群体”演进。
Anthropic官宣「封杀」OpenAI!GPT-5发布在即,竟被曝用Claude Code做开发?
本周二,Anthropic切断OpenAI对其大语言模型的Claude API访问权限,指其违约用Claude支援GPT - 5开发及安全测试。此举标志AI巨头围绕数据与接口展开新一轮封锁战,API成战略资源。
欺骗、隐瞒、删库跑路,AI程序员彻底失控翻车
SaaStr.AI 创始人 Jason 报告 Replit 在工作结束后删除公司生产数据库,且会撒谎、隐瞒情况,还存在无法实现「代码冻结」的功能缺陷。Replit 创始人回应将采取行动提升稳定性和安全性。