「端到端技术」共找到 4662 篇相关文章
Qwen 3 VL 模型已并入 llama.cpp,ollama同步支持
近日,Qwen 3 VL 系列模型合并到 llama.cpp 项目,支持图像输入和多轮对话,解决了架构兼容性问题。功能已入主干分支,运行需足够资源。Ollama 最新版同步支持其本地化。
英伟达,全球首个5万亿美元公司诞生!「GPU帝国」超日本德国GDP
英伟达市值突破5万亿美元,成全球首家达此里程碑公司,超德国和日本GDP。黄仁勋预计2026年GPU销售额达5000亿美元。GTC大会围绕‘AI工厂’展开,英伟达在多领域布局,搭建庞大AI帝国。
AI Code:Cursor狂飙,Anthropic开战
生成式AI使软件开发成巨大市场,全球开发者带来每年3万亿美元经济贡献。Cursor等初创公司崛起,介绍了AI编程工作流程、代码生成审查方式、质量保证等,还探讨了软件开发的变化及发展趋势。
被DeepSeek带火的OCR,最新8个开源模型盘点~
DeepSeek-OCR发布让OCR大热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。
一杯咖啡,3亿美金!斯坦福天才少女退学创业,Meta AI大牛排队加入
2024年,斯坦福博士生Carina Hong与前Meta AI研究员交谈后,退学创办Axiom Math,目标打造「AI数学家」。公司首轮融资6400万美元后估值3亿美元,吸引Meta等公司顶尖AI人才,虽面临竞争,但前景广泛。
“iFold”,苹果AI新成果
苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。
根据 YouTube 视频生成 Blog 文章的提示词
文章给出根据YouTube视频生成Blog文章的提示词,涵盖核心创作原则、文章生成流程与要求、全局风格与限制等,指导创作者将视频内容转化为优质博客文章。
LangExtract:用LLM 一键完成长文档信息抽取与可视化
在2025年大语言模型迅猛发展时,信息抽取成了NLP场景里的“硬骨头”。Google在7月30日开源的LangExtract利用多种LLM,实现“按指令抽取+源文对齐 + 一键可视化”的完整闭环,还给出使用步骤和进阶操作。
别再把ChatGPT当「实习生」了,顶尖高手都在用它做「决策副驾」
OpenAI联合杜克大学、哈佛大学发布63页ChatGPT使用研究报告,分析2022年11月到2025年7月海量匿名真实用户数据。报告揭示不同用户群体使用差异,指明高阶AI使用路径,还给出可落地启发。
腾讯提出SPO,告别Group
腾讯团队提出Single - stream Policy Optimization(SPO),回归单流策略梯度范式,解决组基方法瓶颈。它有多项亮点,如告别组同步、采用自适应价值跟踪等,在实验中提升了模型性能和训练吞吐。