长文本优化」共找到 2117 篇相关文章

新闻资讯8

氛围编程后,Karpathy又双叒有新「脑洞」!PDF将死,未来99%是AI氛围阅读

Karpathy提出未来研究论文不应是PDF格式,未来99%注意力将来自AI,科研成果应为AI优化。此观点源于生物学家Michael Levin关于为AI写作的讨论,引发众多科技思想者回应。

新智元
算法论文8

告别数据「噪音」,UCSD大模型推理新方法DreamPRM充当「信号放大器」,登顶MathVista测评榜

DreamPRM由加州大学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态大模型集成,提升推理能力,实验效果显著。

机器之心
开源动态8

微软炸场了!一张图片仅需3即可生成带完整PBR材质的超高质量3D资产!

微软推出3D资产生成大模型TRELLIS,能接收文本或图像提示,输出高质量3D资产。其结果质量强,支持灵活切换输出格式和局部3D编辑,还给出安装和使用方法及项目地址。

GitHubStore
新闻资讯7

扩散不死,BERT永生!Karpathy凌晨反思:自回归时代该终结了?

苹果前员工Nathan Barry得出BERT本质是文本扩散一步的结论,将表示学习算法改造成生成算法。OpenAI创始员工Karpathy对此沉思,认为生成逻辑在LLM架构中可变。实验证明RoBERTa可转为生成引擎。

新智元
新闻资讯7

V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!

DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。

PaperAgent
产品应用8

MiniMax M3 实测:第一流的模型,已经对执行层动手了

文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。

AI科技评论
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。

InfoQ
新闻资讯8

GPT-5.3 Instant上线:ChatGPT终于不说教了

3月4日OpenAI更新GPT - 5.3 Instant,它重点优化为更准确、少尴尬,情商更高废话更少,联网搜索和写作能力增强,幻觉率降低。还提到GPT - 5.4已泄露,功能强大且将很快到来。

量子位
产品应用8

告别JSON冗余:TOON让Token成本降低30-60%

LLM交互用JSON有冗余,成本高、速度慢。TOON格式专为LLM优化,结合YAML和CSV特点,比JSON减少30 - 60%的token消耗,还介绍了特性、上手方法、集成实践和适用场景。

CourseAI
开源动态8

终于开源升级OmniGen2,统一多模态图像生成模型,真的惊艳。

OmniGen2是强大的开源统一多模态图像生成模型,针对文本和图像模态构建独立解码路径,运用未共享参数。新架构提升处理效率和质量,在图像编辑等任务表现出色,还有多技术特点。

开源AI项目落地