「能碳产业大模型」共找到 10507 篇相关文章
Qwen2.5VL又多一个娱乐场景,看电影讲故事
文章聚焦Qwen2.5VL新娱乐场景“看图讲故事”。介绍视觉叙事目标、挑战,讲述基于StoryReasoning数据集微调Qwen Storyteller模型的解决思路,含核心技术,还给出实战代码及相关链接。
重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI
OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。
Anthropic 产品负责人:PRD 已死,原型万岁
Anthropic Claude Code 产品负责人 Cat Wu 指出,模型指数级进化,产品团队工作方式需重建。PM 不再写 PRD,而做原型、写 eval,团队用 Side Quest 机制,各角色工作本质合流。
18.5K star!一键将电子书转为有声读物,支持1k+语言!
开源君分享开源工具`ebook2audiobook`,能将20多种格式电子书一键转为有声读物,支持超1100种语言,有语音克隆等功能,在Github获18.5K star,安装使用简单。
成本仅0.3美元,耗时26分钟!CudaForge:颠覆性低成本CUDA优化框架
CUDA代码性能对模型训练与推理重要,但手动优化门槛高。明尼苏达大学团队提出CudaForge,是低成本多智能体CUDA Kernel生成与优化工作流,实验效果好,成本低且具通用性。
DiT突遭怒喷,谢赛宁淡定回应
扩散模型核心基石DiT遭网友质疑,称其数学和形式有误,甚至怀疑无Transformer。作者谢赛宁回应抨击标题党,强调科学精神与实证方法,还肯定Tread,推荐Lightning DiT版。
英伟达,开始限制Claude使用了
本文援引The Information报道,英伟达、Palantir等大企业因对敏感数据控制权的顾虑,限制Anthropic Claude前沿模型用于核心敏感业务,探讨了企业级AI落地的新矛盾与行业发展方向。
GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026
近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。
Claude Code 工程师:像 Agent 一样思考
Anthropic 工程师 Thariq 分享构建 Claude Code 时 Agent 工具设计经验,通过 AskUserQuestion 工具迭代、Todo List 到 Task 系统演进等案例,指出工具设计无标准答案,要观察模型行为、反复实验。
OpenAI、Anthropic、DeepMind联手发文:现有LLM安全防御不堪一击
OpenAI、Anthropic、Google DeepMind 联手发文,研究语言模型安全防御评估。指出现有防御评估有缺陷,提出通用自适应攻击框架,成功绕过 12 种防御机制,多数攻击成功率超 90%。