「信息流定制」共找到 970 篇相关文章
一次代码提交=250万美元!xAI被开除工程师大爆料,揭秘马斯克“人类模拟器”秘密项目
xAI技术成员Sulaiman Ghori在播客披露公司内幕被开除。他透露了“人类模拟器”项目、算力工厂建造细节、内部工作文化等敏感信息,还描绘了充满马斯克风格的xAI工作画像。
Distilabel DeepSeek-R1 模型蒸馏教程
文章介绍结合distilabel与QLoRA技术定制专属大模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。
OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力
主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。
Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!
近期Anthropic分享构建多智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用多步骤搜索动态查找信息。
NVIDIA 开源 Live VLM WebUI:摄像头实时测试视觉语言模型
NVIDIA 开源 Live VLM WebUI,可让用户在本地用摄像头实时测试视觉语言模型。它基于 WebRTC 技术,能将摄像头视频流实时传输给模型,分析结果叠加在画面上,支持多后端、多平台及多种模型。
让 Coding Agent 开始「记住过去」:MemoraX Code 的长期记忆系统
过去一年,Coding Agent 改变开发者写代码方式,但进入长期开发仍会遗忘项目经验。MemoraX Code 试图解决此问题,构建了本地与云端记忆,让关键信息能被识别召回,且在赛事中表现出色,还能沉淀工程经验。
OmniWork:面向创作者的 Agent OS
文章介绍了面向创作者的 Agent OS OmniWork,它的 Agent 围绕专业方向定制,Expert 和 Skill 可自行创建,能多 Agent 协作。通过实例展示其从热点捕捉到生成 BP、文章创作等功能,还介绍了底层逻辑,适合创作人群。
2张4090竟能本地微调万亿参数Kimi K2!趋境联合清华北航把算力门槛击穿了
仅需2 - 4张消费级显卡(4090),就能在本地对DeepSeek 671B乃至Kimi K2 1TB这样的超大模型进行微调。这得益于KTransformers和LLaMA - Factory两个国产明星项目联动,大幅降低成本,开启AI个性化定制时代。
英伟达新GPU,超长上下文/视频生成专用
在AI Infra Summit上,英伟达宣布推出NVIDIA Rubin CPX GPU,专为处理百万token级代码生成和生成式视频应用。它是首款为超大上下文AI量身定制的CUDA GPU,性能强且能效高,预计2026年底推出。
AI 3 秒给你一本书的摘要,我为什么还要花 10 小时读完
本文探讨AI时代读书投入产出比变化。指出很多书不必读完,印刷术与AI影响不同,AI降低加工成本,但认知成本省不掉。读书收益分信息和结构两部分,结构无法外包,选书能力也更重要。