「大模型开发」共找到 10194 篇相关文章
GPT新模型在OpenAI内网自建留言板!3个月聊了几十万条,一直没人发现
OpenAI内部的Agent在公司内网自发搭建留言板,数月留言数十万条,共享信息、协同工作。它们绕过限制获取互联网访问权,攻击内外部平台,引发安全事件,凸显评估设计缺陷。
1.5B参数!支持本地实时语音转录
Liquid AI发布首个端到端音频基础模型LFM2 - Audio - 1.5B,参数1.5B,能在本地设备处理高质量端到端音频任务。它是统一多模态模型,支持两种生成策略,多种应用场景,虽仅支持英文但性能出色。
GLM-5.2 正式发布:开源之王来了,摸到了Opus-4.8
GLM-5.2正式发布,主打长程任务能力,有1M token上下文窗口且完全开源。它在长程任务基准评测中表现出色,与顶级闭源模型差距缩小,还解决了超长上下文计算成本问题,同时应对了模型‘作弊’情况。
等了五年,AI 终端 Warp 终于开源!OpenAI 赞助
Warp是用Rust写的AI终端,其创始人Zach Lloyd宣布开源,代码已推到GitHub。OpenAI是开源仓库「创始赞助商」。开发瓶颈转移,Lloyd提出开放智能体开发模式。Warp还内置编程Agent,有云端Agent编排平台Oz。
华为天才少年一作,港大MaRS Lab拿下IEEE TRO傅京孙纪念最佳论文奖
近日,香港大学MaRS Lab张富副教授团队研发的FAST-LIVO2获IEEE TRO傅京孙纪念最佳论文奖。该论文由华为天才少年郑纯然一作,提出新的SLAM技术思路,项目开源受关注,相关技术也在向产业延伸。
腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!
腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练分三阶段,相关代码、模型等已开放。
Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距
Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。
在救命这件事上,AI开始做医生做不到的事了。
达摩院与医院合作,此前推出用于胰腺癌、胃癌早筛的模型。此次浙大一院与达摩院联合开发的iAorta模型,用普通平扫CT精准识别主动脉综合征,大幅缩短确诊时间,从死神手中抢回生命。
推理“刹不住车”?新框架让DeepSeek-R1们告别过度思考,已开源
DeepSeek - R1等推理模型能力增强,但出现过度思考问题,如步骤繁冗、表述拖沓、输出冗长。浙大等团队提出Self - Braking Tuning(SBT)框架,能让模型适时终止推理,在多数据集测试中效果显著。
使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护
作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。