COSCon‘25 首日随感:开源进入“深水区”,热闹背后是更务实的生态
朋友们,刚从国家会议中心回来,腿还是软的。COSCon(中国开源年会)今年办到第十届,恰好是“COSCon”这个牌子走过的第十个年头。作为一个从第一届就开始“蹲守”的老观众,我必须说,今年的首日现场,跟往年那种纯粹靠情怀和激情撑起来的氛围完全不同了——人多、项目多、讨论的问题也更“硬核”了。如果你没到场,或者正准备明天去,这篇我蹲了一天展区、串了三个分论坛、跟七八个社区摊主聊完的复盘,应该能帮你少走不少弯路,也能让你知道今天现场到底释放了什么信号。
先别急着说“又是活动回顾”。我尽量不写那种“领导致辞、嘉宾合影”的流水账,只聊我在现场看到的真实变化:开源这件事,正在从“参与者的狂欢”变成“整个技术生态的基础设施”。主论坛上聊的不再是“要不要开源”,而是“开源之后怎么活下去、怎么治理、怎么让AI时代的新玩家愿意回来继续贡献”。这背后涉及的其实是开源许可证选型、社区治理、商业模式、文档建设、以及AI大模型与开源的关系等一堆非常实际的问题。
这篇文章适合这么几类人看:一是明天准备去现场、想知道怎么逛最不亏的;二是做开源项目、想知道现在社区生态风向的开发者;三是想参与开源但一直没找到入口的新人,我会把今天在各个展台打听到的新手起步路径整理出来。注意,这篇不是官方新闻稿,是我个人视角的记录和判断。
1. 主论坛里那些值得细品的变化
1.1 开幕式基调:开源进入“深水区”,议题从“利他”转向“可持续”
上午的主论坛,我最大的感受是:台上的嘉宾们都在聊一个词——“可持续”。十年前我们聊开源,讲的是“社区”、“分享精神”、“程序员改变世界”;今年大家聊的却是“资金从哪里来”、“治理结构怎么搭”、“怎么让贡献者长期留下来”、“怎么让企业愿意把核心资产拿出来开源”。
这不是变味了,而是生态成熟的必然过程。任何一个开源项目,从诞生到被广泛采用,都会经历三个阶段:初期靠个人英雄主义撑起第一个可用版本;中期靠社区贡献丰富功能、修复bug;后期则必须解决“谁出钱、谁决策、谁受益”的问题。今年主论坛上好几个演讲都指向这个阶段——有一个项目让我印象很深,他们在台上直接晒出了过去一年的财务透明报表,包括收到的捐赠金额、企业赞助、以及这些钱具体花在了哪些基础设施上。这个做法我觉得特别聪明,因为开源社区最怕的不是没钱,而是钱来了之后不透明引发的信任崩塌。
另外,主论坛上关于开源标准化的讨论明显变多了。以前我们总觉得“开源就是代码开放”,但今天几位嘉宾反复提到“开放标准”、“开放数据”、“开放文档”的概念。这背后的逻辑其实很清晰:一个项目要想成为生态底座,光开放源代码是不够的,还需要配套的接口规范、数据格式规范、安全准则、贡献流程文档。否则别人想集成你的项目,光靠读代码是玩不转的。
1.2 AI 正在重塑开源的“游戏规则”
如果说今年会场里哪个词出现的频率最高,不是“Kubernetes”,也不是“大模型”,而是“AI + 开源”的组合。从主论坛到展区,几乎每个展台都在聊AI相关的东西。但有意思的是,大家聊的重点已经不是“用开源框架训练模型”这种老话题了,而是“开源模型出来后,怎么把它落地到业务场景”里的那些琐碎问题。
我在展区听到好几个参会者在咨询:开源大模型从哪些网站下载比较靠谱?本地化部署需要什么样的硬件配置?量化之后模型效果损失多少?这些问题是过去一年开源社区里非常典型的新需求。以前开源软件的“安装部署”门槛主要在依赖管理,现在AI开源项目把门槛抬高了整整一个档次——你需要懂Python环境、懂CUDA、懂显存管理、懂推理优化,这对很多传统业务开发者来说是一个不小的台阶。
另一个很有意思的现象是,AI相关的开源项目已经成为贡献者增长最快的赛道。今天在几个展台聊天时,好几个项目维护者都提到,最近一年收到的外部PR(Pull Request)数量是过去几年的总和。原因不难理解:AI项目迭代速度快、技术栈统一(大多基于Python和PyTorch)、而且“训练/推理”的过程有比较明确的benchmark可以验证改进效果,新手更容易找到“能上手”的切入点。相比之下,一些老牌基础设施项目的维护者则抱怨新贡献者变少了,愿意啃底层C/C++代码的人越来越少,这也是开源生态一个值得警惕的信号。
1.3 圆桌讨论:开源的商业模式到底该怎么走
下午有一场圆桌我很喜欢,话题是“开源项目的商业化路径”。现场争论挺激烈的,甚至有点“火药味”。一方认为开源项目就应该靠服务、培训、云托管这些“周边”赚钱,核心代码必须保持完全自由;另一方则认为,如果辛辛苦苦把项目做起来,结果被云厂商直接打包成托管服务卖钱,项目团队反而一分钱赚不到,这不是“开放”,这是“被薅羊毛”。
这个争论其实指向一个非常现实的问题:开源许可证到底怎么选。现场有人问“Gitee上开源项目许可证选什么合适”,这问题确实很典型。很多新手项目作者在发布第一个版本时根本没想过这个问题,随手选了一个MIT或Apache 2.0,等到项目做大了、有了商业价值,才发现当初的许可证选择让自己失去了对项目商业化路径的控制权。
我个人的建议是:如果你是个人开发者,做的是工具类、库类项目,希望被尽可能多的人采用,Apache 2.0是比较稳妥的选择,它既有宽松的使用条款,又包含明确的专利授权条款,对采用方比较友好。如果你希望防止大型云厂商直接把你的项目做成托管服务卖钱,可以考虑加入一些“反云厂商”条款的许可证(比如类似Elastic License或Commons Clause的思路),但这类许可证往往不被OSI认定为“开源许可”,会损失一部分社区认可度。这本质上是一个“社区广度”和“商业保护”的取舍,没有绝对正确的答案,关键是在做项目第一天就认真决策,而不是等火了之后再补救。
2. 展区逛下来的一些收获
2.1 社区展台是“开源社交”的主场
说句实话,COSCon这种年会的展区,往往比主论坛更有料。主论坛的分享虽然视角高,但很多内容在官网上能看到;展区里的对话才是真正文档里写不出来的“活信息”。
今年展区的规模比去年又大了不少,道路两侧摆满了各个开源社区、基金会、以及拥抱开源的企业展台。我粗略估算了一下,大大小小的展位有几十个。从openEuler到OpenHarmony到openKylin这些操作系统社区,再到各种AI、数据库、嵌入式、开发者工具项目,几乎你能想到的技术方向都能找到对应展台。
为什么我觉得展区比论坛重要?因为在这里,你遇到的人往往是项目的核心维护者或活跃贡献者,而不是商业公司的市场人员。你可以直接问“我这个场景用你的项目适合吗?”“文档里没写清楚的地方,你们实际是怎么做的?”“有没有什么已知的坑是我需要避开的?”这些问题在主论坛上永远得不到答案,但在展台前,一杯咖啡的时间就能聊通透。
我下午在一个做嵌入式操作系统的展台前站了十几分钟,听一位维护者给来咨询的学生讲他们项目从零到一的故事。他提到一个很实在的观点:嵌入式方向的开源项目,光是代码本身是不够的,开发板的适配、外设驱动的完善、文档的中文化,这些事情往往比内核代码还影响用户的体验。这话说到我心坎里了,很多开发者做开源只盯着“主仓库”那几千行代码,但其实整个生态的护城河是在你根本看不见的side projects里慢慢挖出来的。
2.2 今年最火的项目方向,藏在展台的人流密度里
展区逛展有个诀窍:看哪个展台前面围的人多,大致就知道今年什么方向最热。根据我今天的观察,热度第一梯队的是AI相关项目。有一个做本地知识库和文档处理的AI项目,演示屏前围了一圈人,工作人员在展示“任何格式转换为Markdown”这个功能,确实很惊艳。你丢一个PDF、一张扫描件,它就能自动提取文字和版式,输出结构化的Markdown文件,然后你可以直接喂给大模型做问答。这个“格式转换 + 知识库整理”的需求,在AI落地场景里确实非常刚性。
热度第二梯队是嵌入式与硬件方向。比如围绕STMicroelectronics的STM32生态的开源项目,以及FPGA相关的开源工具链,展台前始终保持着较高的人流量。我跟一位做FPGA开源工具链的开发者聊了一会儿,他说这两年最大的变化是“下游用户终于不只是学生了”,开始有越来越多的工业界工程师在工作中尝试用开源FPGA工具链做原型验证。因为商业FPGA工具链的授权费实在太贵,很多中小公司根本负担不起,开源方案虽然功能上还有差距,但至少让“先试试看”变成了一件成本极低的事情。
还注意到一个有意思的现象:今年“效率工具”类的开源项目多了很多。比如开源的桌面分屏管理软件、OCR文字识别工具、Markdown编辑器、笔记知识库系统等。这类项目的共同特点是:解决的是个人开发者日常痛点,体量不大,但用户粘性极高。它们的存在说明开源不只是“大厂的游戏”,个人开发者靠小而美的工具也能获得非常忠实的用户群体。
2.3 开源新人该怎么起步:现场问出来的干货路径
今天在展区,我遇到好几个想参与开源但找不到入口的同学,在各个展台前徘徊,不知道该怎么开口问“我能为这个项目做什么”。说实话,这个困惑太正常了,因为很多成熟开源项目的外部贡献门槛其实并不低,尤其是那些代码结构复杂、测试体系庞大的基础设施项目。
我在几个展台帮这些同学问了问维护者们“新人应该从哪入手”,答案汇总起来大概有三类:
第一类是文档贡献。很多项目功能很强大,但文档质量堪忧“能用”和“好用”之间隔着十万八千里。维护者普遍表示,任何文档改进的PR,哪怕是修正一个错别字、补充一个使用示例、完善一段API说明,都会被认真review并快速合入。这对新人来说是最低门槛的起步方式,还能在过程中熟悉项目的协作流程。今天也有人提到“开源文档贡献”这个方向,确实值得重视——它是开源社区中最容易被低估、但也最容易被感谢的工作。
第二类是从good first issue入手。GitHub上的开源项目很多会专门给新人标记“good first issue”,这类issue通常范围明确、不需要对项目有全局理解、且会有人指导。问题是,一些热门项目的good first issue往往放出来没几天就被抢光了,所以你需要时不时刷一下,或者订阅项目的release通知。
第三类是参与本地化和国际化翻译。很多开源项目的界面、文档都只有英文版本,中文社区用户很难上手。做翻译和本地化,不仅能帮你熟悉项目的每一个功能点,还能让你快速成为项目的“KOL”之一,因为你做的翻译替代了后来所有中文用户的阅读路径。今天现场就有个维护者说,他们项目的中文文档翻译者,后来成了core contributor。
3. 分论坛现场记录:技术人的主场
3.1 嵌入式与操作系统分论坛:开源与“硬”技术的化学反应
下午我抽空去了一趟嵌入式与操作系统分论坛,现场的座位已经坐满了大半。几个演讲听下来,我最大的感触是,嵌入式领域开源化的进程,正在从“可用”走向“好用”。
为什么这么说?以前嵌入式开发讲开源,基本上就是“用开源编译器(GCC) + 开源调试工具链 + 一个裸机RTOS”,剩下的全靠各厂商的闭源SDK。但现在不一样了。论坛上有位工程师分享了他们团队在一款量产级工业设备上,完全使用开源实时操作系统和开源中间件栈构建网关的案例。他特别提到了几个关键点:“内存占用控制在XX KB以内”、“上下文切换时间在XX微秒量级”、“中断延迟的确定性能够满足我们的控制周期要求”。这些数据放在PC生态里可能不算什么,但在嵌入式场景里,每一个数字背后都是无数个不眠夜换来的优化成果。
另一个让我印象深刻的话题是关于开源鸿蒙PC版的进展。现场虽然没有正式发布新闻,但相关社区展台前一直有人咨询下载入口、硬件适配情况以及开发环境搭建方式。围绕PC场景的开源操作系统,的确是很多开发者希望看到的方向,因为它意味着桌面端生态真正多了一个可选的技术底座。不管最后能走到哪一步,有更多开源选择对开发者来说总归是好事。我也顺便去相关展台聊了一下,工作人员说,目前大家用虚拟机或者老笔记本跑得比较多,硬件的驱动兼容性是目前反馈最多的“开坑”来源,这倒是很符合PC系统的现实情况。
3.2 AI Infra 分论坛:跑模型、调性能、省显存,全是实战经验
AI Infra的分论坛可以说是今天技术含量最高的一个场子。演讲者基本都在聊“怎么做工程”,而不是“模型有多强”。有人讲开源MES系统carbon的本地部署实践,有人分享在有限GPU资源下如何用量化、剪枝、投机采样这些优化手段把推理吞吐量提上去,还有人现场演示了一套基于开源组件搭建的私有化部署方案,全程不碰任何云端商业API。
这个论坛透露出一个很清晰的信号:AI落地的瓶颈已经从“模型能力”转移到了“工程适配能力”。模型开源了、权重放出来了,但你要在一个特定的业务场景里把模型跑起来、跑得稳、跑得便宜,这中间的活非常多。今天好几个演讲者都在讲同一个故事:“我们一开始用的是商业API,但发现数据合规、成本控制、响应延迟都满足不了要求,所以决定自己本地部署开源模型。” 这个故事的开头,和我过去一年听到的无数个企业AI落地案例一模一样。
对准备自己动手做AI本地化部署的朋友,我的建议是:先从量化模型入手,8-bit 甚至 4-bit 量化后的模型对显存需求大幅降低,单卡就能跑;别一上来就追求最大参数量的模型,先跑一个7B/8B级别的,把推理框架、API接口、业务逻辑打通之后,再考虑升级到更大的模型。另外,监控推理服务的GPU显存占用和延迟分布是必须做的基础工作,否则线上出问题你连排查方向都没有。
3.3 开源文档与协作分论坛:好文档是“被设计出来的”
说实话,我以前对“开源文档”这个topic并不太感冒,总觉得写文档是件“重要但不紧急”的事情,不值得专门开一个分论坛来讲。但今天抱着“随便听听”的心态进去坐了一会儿,发现自己错得挺离谱。
演讲者提出一个概念我很赞同:文档其实是开源项目最容易被忽视的“用户界面”。对于新用户来说,一个项目的README、安装指南、API参考文档,就是他们和这个项目的第一次交互。如果这个“界面”体验糟糕,不管代码写得多优雅,用户也会被劝退。
论坛上有人分享了一套非常系统的“文档即代码”工作流:文档和代码放在同一个仓库里维护、用Markdown编写、通过自动化工具做格式校验和链接检查、持续集成流水线里跑文档构建、文档的修改也必须走PR review流程。这套做法跟主论坛上提到的“开源标准化”是互相呼应的——一个成熟的开源项目,代码仓库和文档仓库应该是同等重要的“一等公民”。
这里也正好回应了一个我今天在现场反复听到的问题:“任何格式转换为Markdown开源项目”到底哪里有?其实这类工具确实是现在文档流程里的刚需。无论是PDF、Word、还是扫描件,如果能方便地转成Markdown,后续写文档、喂AI、做知识库都会省力太多。今天展区那个演示效果不错的工具,其实也是类似思路。如果你有这方面的需求,建议直接在GitHub上以“markdown converter”或“pdf to markdown”为关键词搜索,有很多开源选择,选一个star数量足够、维护活跃的就行。
4. 给明天到场或云逛展朋友的实用建议
4.1 首日最容易踩的“坑”
今天一天走下来,我自己也踩了几个坑,整理出来给明天到场的各位提个醒。
第一个坑是热门分论坛的座位问题。我下午去AI Infra分论坛时,提前到了十分钟,结果大厅里已经坐得满满当当,只能站在最后面听完一整场。如果是你特别想听的分享,强烈建议至少提前十五到二十分钟进场。
第二个坑是手机很快就没电了。一天下来,扫码加微信、看议程、拍PPT、查项目仓库……电量消耗速度远超日常。现场虽然有充电区域,但插座数量有限,自己带充电宝才是王道。
第三个坑是收集了一堆贴纸和纪念品,回来发现没几个有用的。说实话,展台上的小礼品确实诱人,但真正的收获应该是和展台维护者交换联系方式、拿到项目进群的二维码、加到那个能随时问问题的开发者微信。这些东西才是年会后你能持续获得价值的东西。
第四个坑不太容易注意到:下午三四点之后,很多展台的工作人员就已经开始撤了,如果你想问的问题需要等待排队,建议上午到中午就把想深度聊的展台都逛完。
4.2 一天最多信息量的逛法
如果你只有一天时间且明天第一次来,我建议的排布逻辑是:上午听主论坛抓趋势,下午选一个有技术深度的分论坛深潜,剩下的碎片时间用来逛展区。这样既能看到“面”上的风向,又能深入“点”上的技术细节,还能攒下不少展区才有的一手社区信息。
主论坛今天早上有几个分享还是很有价值的,包括开源治理、AI基础设施、全球开源趋势这类宏观点;但这些内容听的时候很燃,回来后很难直接落地。真正能在工作里用上的,反而是分论坛那些具体到“我们公司是怎么用某个开源组件解决问题的”案例。所以如果时间有限,我的建议是压缩在主论坛的时间(听完第一个主旨演讲和圆桌就可以撤了),把大块时间留给分论坛和展区。
另外特别提醒:社区展台的价值不完全在“看”而在于“问”,你在使用某个开源项目中长期解决不了的问题,很有机会在这里得到核心维护者一两句话的点拨,这比你回去之后重新翻一整天文档都要高效。今天我就亲眼看到有人在展台前问了一个关于性能调优的问题,维护者直接现场操作演示了一把,围观群众都看值了。
4.3 想从“旁观者”变成“贡献者”?这届年会就是最好的起点
如果你是一个从来没给开源项目提交过代码的开发者,我的建议是:别把目标定成“在年会上学很多技术”,而是定成“找到那个你想贡献的第一个项目”。
操作路径很简单:明天到了现场,直接去找你日常工作中正在用的那个开源项目的展台。当面跟维护者说三句话:“我在用你们的项目”、“我在XX场景遇到了一个问题”、“我想为这个项目贡献一些代码,你们觉得从哪个模块入手比较合适?” 这三句话递出去,大概率能换回一段比你在GitHub上摸索一周还要有价值的交流。
今天在展区,我就看到有志愿者拿着“开源之夏”和“开源众包”的宣传册,给围观的同学们讲怎么通过带教机制进入开源社区。这类活动本质上是给新人提供一个有经验的人带路的“实习式”机会,方向明确、任务清晰、且有导师review你的代码。对于很多不知道如何迈出第一步的新人来说,这种“组织化”的入口比你自己在GitHub上大海捞针要靠谱得多。
5. 首日收官,说几句掏心窝的碎碎念
写到这里已经有些长了,但还有一些今天在现场想到的、想跟大家分享的东西。
一个很深的感触是,COSCon这十年,确确实实见证了中国开源生态从“星星之火”到“百川汇流”的过程。十年前我们讨论开源,更多是在讲“国外那些大项目怎么参与”;而今天,我在现场看到越来越多由中国开发者发起、由中国社区主导、并且真正吸引了全球贡献者参与的项目。开源这件事,正在从一道“可选题”变成一门“必修课”。
晚上从国家会议中心出来时,天已经黑了,门口还聚集着几群聊得意犹未尽的人,互相加着微信,嘴里讨论的还是白天没聊完的技术细节。路边有位大哥拿着笔记本,在昏黄的路灯下给旁边两个人演示一段代码——可能是展会上认识的新朋友,正在就某一个开源项目的实现细节做“现场加时”。这种松弛又认真的氛围,我觉得才是COSCon最迷人的部分。
明天的日程里,我最期待的是闪电演讲和几个小范围的技术工作坊。闪电演讲聚焦“今天现场还没聊够的话题”,工作坊则会让你动手实操一个具体的开源项目。如果你今天没来得及跟心仪项目的维护者搭上话,明天建议一定要主动一点——开源社区最不缺的就是“好为人师”的前辈,你只要敢问,他们一般都会非常乐意分享一路踩坑的经验。
最后再分享一个小技巧:参会时别只顾着看手机里的日程,多抬头看看墙上的海报和横幅。很多社区会在不起眼的角落贴出“帮帮我们:需求文档翻译 / bug triage / 社区运营”的小纸条。对新人来说,这类任务往往比写代码更容易上手,也更容易让你快速融入一个社区。
行了,今天的回顾就到这里。明天我还会继续泡在现场,有什么新的见闻再随时分享。祝明天到场的各位逛展愉快,收获满满。