LeCun强推了一个3b小模型,你的cpu都能跑
最近硅谷这些企业真是搞得火热老黄联名推动开源今天又搞联名信呼吁控制AI发展。感觉从k3发布之后这些段子都没消停过。打开抱抱脸的趋势榜k3已经冲到了第一。2.8T的参数部署起来得个两千万成本吧大佬们是真有实力。百度的unlimited-ocr发布一个来月了到现在还能排在第二名也是不简单。很多朋友可能都没听说过这个模型但最近确实还挺火经常能刷到早上还看到杨立昆转帖了。话说回来 ocr这个词听起来真的很老了这几年随着模型越来越牛逼对输入的语料内容越来越鲁棒了。上一次它给我留下深刻印象还是前AI时代在微信截图可以直接把图片上的文字复制出来当时是真觉得科技牛逼。遇到模型照旧小小测试一下。百度最近几年的paddleocr一直表现都挺好的可能比monkey-ocr、dots.ocr更好用。那为啥又折腾了一个unlimited-ocr呢看了下readme这个版本的核心发力点是无限。大模型的生成的越长上下文累计的越长所以之前ocr的模型都需要分页解析。 但unlimited-ocr可以直接把几十页的文档丢进去一次性吐出来解析结果。在hf上可以直接免费测试 原地把kimi k3的报告扔进去了47页pdf。就是免费的spaces有点慢 差不多30s一页。 一页大概1000tokens左右 实际就3b 自己部署应该很快cpu都能跑的程度。ocr的解析从结果来看除了不需要分页解析省事。 最大优势是各种排版都保留。下图这个表格里边的图片是占了3行在最右边一列。 如果是普通的python解析早没了这些信息。这种端到端不需要啥预处理后处理的ocr模型确实省事用起来方便多了。 可能都不需要mineru这类壳子了现在国产模型口碑越来越好了。不管是大模型还是小模型在抱抱脸、x上很受欢迎。反倒是A/ 给自己折腾的在中英文社区的口碑一落千丈。(dario写2000字小作文的时候内心可能在想开源是不可能开源的。 我能蒸馏你们的你们不能蒸馏我的。你的是我的我的还是我的。)昨天商务部还有个发言也特牛近200家美国初创企业敦促美国政府不要切断对中国开源模型的访问。哦对了。 那个ocr模型我还做了之前业务上的变态手写体识别似乎不管是fable还是百度这个新模型或者kimi k3试遍了也没法100%识别对。也许当字写得丑的时候找啥ocr也不管用。但毕竟200多万人下载了感兴趣的朋友绝对可以本地部署玩玩。学AI大模型的正确顺序千万不要搞错了2026年AI风口已来各行各业的AI渗透肉眼可见超多公司要么转型做AI相关产品要么高薪挖AI技术人才机遇直接摆在眼前有往AI方向发展或者本身有后端编程基础的朋友直接冲AI大模型应用开发转岗超合适就算暂时不打算转岗了解大模型、RAG、Prompt、Agent这些热门概念能上手做简单项目也绝对是求职加分王给大家整理了超全最新的AI大模型应用开发学习清单和资料手把手帮你快速入门学习路线:✅大模型基础认知—大模型核心原理、发展历程、主流模型GPT、文心一言等特点解析✅核心技术模块—RAG检索增强生成、Prompt工程实战、Agent智能体开发逻辑✅开发基础能力—Python进阶、API接口调用、大模型开发框架LangChain等实操✅应用场景开发—智能问答系统、企业知识库、AIGC内容生成工具、行业定制化大模型应用✅项目落地流程—需求拆解、技术选型、模型调优、测试上线、运维迭代✅面试求职冲刺—岗位JD解析、简历AI项目包装、高频面试题汇总、模拟面经以上6大模块看似清晰好上手实则每个部分都有扎实的核心内容需要吃透我把大模型的学习全流程已经整理好了抓住AI时代风口轻松解锁职业新可能希望大家都能把握机遇实现薪资/职业跃迁这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

相关新闻

OneDragon:基于计算机视觉的游戏自动化框架架构设计与实现

OneDragon:基于计算机视觉的游戏自动化框架架构设计与实现

OneDragon:基于计算机视觉的游戏自动化框架架构设计与实现 【免费下载链接】ZenlessZoneZero-OneDragon 绝区零 一条龙 | 全自动 | 自动闪避 | 自动每日 | 自动空洞 | 支持手柄 项目地址: https://gitcode.com/gh_mirrors/ze/ZenlessZoneZero-OneDragon 技术…

2026/7/29 21:35:09 阅读更多 →
深入理解FFTformer-GoPro-fp32架构:FSAS与DFFN模块如何重塑图像恢复技术

深入理解FFTformer-GoPro-fp32架构:FSAS与DFFN模块如何重塑图像恢复技术

深入理解FFTformer-GoPro-fp32架构:FSAS与DFFN模块如何重塑图像恢复技术 【免费下载链接】FFTformer-GoPro-fp32 项目地址: https://ai.gitcode.com/hf_mirrors/mlx-community/FFTformer-GoPro-fp32 FFTformer-GoPro-fp32是一款基于Apple MLX框架的图像去模…

2026/7/29 21:35:09 阅读更多 →
oled滑轨屏LED滑轨屏旋转开合屏

oled滑轨屏LED滑轨屏旋转开合屏

好的,请看为您创作的这篇自媒体专业分析文章:作为一名在数字展陈行业摸爬滚打了15年的老兵,我见过太多客户在选互动滑轨屏时踩坑。动辄几万、十几万的投入,选错类型,效果直接减半。今天,我们不谈虚的&#…

2026/7/29 21:35:09 阅读更多 →

最新新闻

NAD激酶活性检测:偶联酶比色法在辅酶代谢与氧化还原平衡研究中的精密工具

NAD激酶活性检测:偶联酶比色法在辅酶代谢与氧化还原平衡研究中的精密工具

NAD激酶(NADK)活性检测试剂盒在NADP(H)合成与细胞代谢调控中的关键地位在细胞的辅酶代谢网络中,烟酰胺腺嘌呤二核苷酸(NAD⁺)和烟酰胺腺嘌呤二核苷酸磷酸(NADP⁺)及其还原形式NADH和NADPH&#…

2026/7/29 21:44:13 阅读更多 →
深入理解Arcade依赖流:Darc与Maestro实现自动化更新

深入理解Arcade依赖流:Darc与Maestro实现自动化更新

深入理解Arcade依赖流:Darc与Maestro实现自动化更新 【免费下载链接】arcade Tools that provide common build infrastructure for multiple .NET Foundation projects. 项目地址: https://gitcode.com/gh_mirrors/arca/arcade Arcade是为多个.NET Foundati…

2026/7/29 21:44:13 阅读更多 →
5个终极策略:用virtio-win彻底提升Windows虚拟化性能

5个终极策略:用virtio-win彻底提升Windows虚拟化性能

5个终极策略:用virtio-win彻底提升Windows虚拟化性能 【免费下载链接】kvm-guest-drivers-windows Windows paravirtualized drivers for QEMU\KVM 项目地址: https://gitcode.com/gh_mirrors/kv/kvm-guest-drivers-windows 在KVM/QEMU虚拟化环境中运行Windo…

2026/7/29 21:44:13 阅读更多 →
开发者视角:Ninjabrain-Bot的末地城生成机制模拟与代码架构

开发者视角:Ninjabrain-Bot的末地城生成机制模拟与代码架构

开发者视角:Ninjabrain-Bot的末地城生成机制模拟与代码架构 【免费下载链接】Ninjabrain-Bot Accurate stronghold calculator for Minecraft speedrunning. 项目地址: https://gitcode.com/gh_mirrors/ni/Ninjabrain-Bot Ninjabrain-Bot是一款专为Minecraft…

2026/7/29 21:44:13 阅读更多 →
TEL 3M80-004459-Z2PCB 板组件

TEL 3M80-004459-Z2PCB 板组件

TEL 3M80-004459-Z2 PCB板组件,其中间区域布设的15条关键线路,其特点如下:采用等长设计,确保信号同步传输。线宽严格控制,保证阻抗一致性。相邻线间距优化,降低串扰风险。线路走向规整,便于生产…

2026/7/29 21:44:13 阅读更多 →
hai洛hi原图怎么下载,一张图说清楚Shutterstock如何下载

hai洛hi原图怎么下载,一张图说清楚Shutterstock如何下载

2026/7/29 21:43:12 阅读更多 →

日新闻

【RT-DETR多模态创新改进】CVPR 2025 | 独家特征融合创新改进篇 | 引入RLAB残差线性注意力模块,有效融合并强调多尺度特征,多种改进点,适合红外与可见光融合目标检测任务,有效涨点

【RT-DETR多模态创新改进】CVPR 2025 | 独家特征融合创新改进篇 | 引入RLAB残差线性注意力模块,有效融合并强调多尺度特征,多种改进点,适合红外与可见光融合目标检测任务,有效涨点

一、本文介绍 🔥本文在RT-DETR多模态融合目标检测中引入RLAB残差线性注意力模块,可在不同模态特征交互阶段进行多次残差细化,使可见光、红外等特征在尺度、语义和空间位置上更好对齐;随后将细化特征与解码器输出拼接并生成Q、K、V,通过线性注意力自适应强化关键通道、目…

2026/7/29 0:00:23 阅读更多 →
AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础

AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础

AI编程系列02:合并知识功能,给 AI 问数和 RAG 场景打基础 在上一期「AI编程系列」中,我们学习了如何构建一个基础的 AI 问答系统,通过简单的输入输出让模型回应问题。但现实世界中的 AI 应用往往需要处理更复杂的场景:…

2026/7/29 0:00:23 阅读更多 →
AI智能体开发实战:从工具调用到企业级部署

AI智能体开发实战:从工具调用到企业级部署

1. 从被动问答到主动执行:AI Agent的范式转变过去两年,大语言模型最显著的应用形态是聊天机器人——用户提问,AI回答。但真正的生产力革命发生在2023年下半年:当AI学会主动调用工具完成任务时,生产力工具的历史被彻底改…

2026/7/29 0:00:23 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/28 12:04:22 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/29 15:00:03 阅读更多 →

月新闻