国内我的网站主页 > 我的网站国内 >
摘要:长城...

影视风云路

千问还是不够自信_我的网站

女生名叫黄蒲军校

A |     시유지 바위에 밧줄 묶어 공유수면에법적 제거 권한에도 실태조사 전무시·남구 “해수면은 해수청 관할” 주장해수청은 “어선은 지자체 업무” 반박                   울산시 기념물 처용암 앞 공유수면에 어선들이 계류해 있다. 이곳은 항만법상 정식 계류지나 정박지가 아니지만 울산시와 울산지방해양수산청 간 단속 주체의 시각차가 있어 행정공백이 발생하고 있다. 오상민 기자울산시 기념물인 처용암 앞바다에 어선 10여 척이 정식 계류지가 아님에도 장기간 무단 계류하고 있지만, 관계 기관들은 서로 관할이 아니라며 책임을 미루고 있다.26일 찾은 울산 남구 황성동 처용공원 일원. 처용암이 바라보이는 해변에는 소형 어선과 요트 등 선박 10여 척이 줄지어 떠 있었다. 배들은 정식 계류시설 대신 과거 세죽마을 시절 사용하던 낡은 선착장 흔적과 해안가 돌부리에 밧줄을 묶은 채 떠 있었다. 일부 선박은 닻을 내리지 않고 육지 바위에 계선줄을 고정해 놓았다.선박들이 육지에 밧줄을 묶어둔 곳은 울산시 소유의 공원부지와 일반 시유지가 섞여 있다. 특히 처용암 일대 해수면은 정식 계류시설이나 정박지로 지정되지 않은 일반 공유수면이다. 울산항만공사에 따르면 이 일대는 울산항 항계에 포함되지 않으며, 어촌정주어항이나 마을공동어항으로도 등록돼 있지 않다. 이에 선박들이 장기간 묶여 있는 만큼 공유수면 이용 실태에 대한 행정기관의 점검이 필요하다는 지적이 나온다.공유수면 관리에 관한 법률에는 계류된 선박 등이 공유수면의 효율적 이용을 저해하거나 수질오염을 일으킬 우려가 있다고 인정되는 경우 공유수면관리청이 소유자 또는 점유자에게 제거를 명할 수 있도록 하고 있다. 다만 공유수면관리청은 해양수산부장관뿐 아니라 시장·군수·구청장 등 모두 가능하도록 규정돼 있다.                   지금은 집단 이주로 사라진 옛 세죽마을 나루터로 추정되는 곳에 어선과 요트 등이 계류해 있다. 오상민 기자이처럼 해당 행정 처리를 여러 기관이 동시에 할 수 있도록 규정하고 있지만, 현실은 그 때문에 기관들이 서로 미루는 바람에 오히려 제대로 행정 처리가 안돼 방치되는 실정이다.실제로 울산시는 해역의 관리가 울산지방해양수산청 소관이라는 입장인 반면, 울산해수청은 무역선 등을 중심으로 관리하고 일반 소형 어선의 계류 문제는 지자체가 담당해야 한다고 답했다. 남구 역시 해상 선박 관할이 해수청에 있다며 과거 조치 요청 공문을 보낸 것 외에는 적극적인 조치를 하지 않고 있다.법에 따라 방치·계류 선박의 상태와 공유수면 이용 지장 여부 등을 조사한 뒤 제거 명령 등을 검토할 수 있지만, 어느 기관도 책임 있게 실태조사에 나서지 않으면서 행정 공백이 이어지고 있는 셈이다.무단 계류가 자리 잡은 배경에는 산업화와 공해로 사라진 옛 포구의 역사가 있다. 처용암 일대 세죽마을은 일제강점기 김·굴 양식과 도선 나루터가 번성했던 어업기지였다. 하지만 1970년대 외항강 상류에 석유화학공단이 들어서면서 공해지역으로 변했고, 주민들은 1999년 집단 이주했다.울산시는 이후 2004년 세죽마을 일대를 처용 문화공원으로 지정했지만 20년 넘게 공원 조성이 완료되지 않았다. 대체 계류지 마련이나 기존 어선 정비도 이뤄지지 않으면서 옛 나루터 흔적 주변에 어선들이 하나둘 자리 잡았고, 무단 계류가 관행처럼 굳어졌다.울산대 정책대학원 유영준 겸임교수는 “처용암은 삼국시대부터 이어져 온 설화와 맞닿아 있는 유서 깊은 장소인데도 그동안 지자체, 정부부처 등 모두 관심이 덜했던 것이 사실”이라며 “행정기관들이 서로 관할을 미룰 것이 아니라 역사적 의미를 고려해 보다 세심하게 관리하고 정비할 필요가 있다”고 지적했다.。    这几天国模简直像在开大会。先是k3搞了个大新闻,然后昨天qwen3.8又发布了,都是2T以上的大参数模型。据说今天deepseek v4也要发布,本来想等v4发布一起聊,可惜没等到。         不过光是目前千问这一波操作,就已经有不少值得琢磨的门道。         时机上,Kimi K3刚刚发布,而且表现非常亮眼;DeepSeek v4即将发布,水平未知,但按照梁圣的一般水准肯定值得期待。         夹在这两家之间,qwen3.8的局面就有点尴尬,要是模型能力打不过k3,性价比搞不过v4,对外口径上不好宣传。         另外值得关注的地方是,阿里这次发布时就明确将开源qwen3.8。(公众号推文作者都变成了“蓄势待发要开源的”千问大模型)          林俊旸当初离职,有个因素就是集团对开源的态度有调整,开始更多考量开源的成本收益。

B |          阿里前段时间也的确有这种迹象,从“积极拥抱开源”转向“有条件拥抱开源”和“选择性开源”。qwen3.8 max的开源承诺,表明阿里重新回归了过去三年的主路线。                   翻译跟措辞的艺术          比较有意思的是,千问中英文官方账号发布的介绍有个很细微的区别。英文版直接说的 "second only to Fable 5",仅次于 Fable 5。         但是中文版居然加了个“可能”,原话是“可能是除了Fable 5外最强大的模型”。这个让人不太理解,难道官方其实也不是非常确定qwen3.8的水平,还是说担心国内放卫星容易被冲?          千问还是不够自信。         国内几家搞大模型的,阿里算是比较喜欢放卫星的。这跟管理层风格有关系,每次开财报会阿里也是最乐观的。         最典型的就是之前快乐马,当时出来跑分屠榜一骑绝尘,但等大伙冷静下来用过后发现模型表现跟预期有明显差距。当时那种跑分太猛,一定程度上影响了观感。         当然结果是好的,起码阿里高层认可,因为负责人张迪现在一统集团的多模态视觉业务线,万相、快乐马和快乐生蚝全都并入了未来生活实验室。         可能也是吃过亏,阿里这次在基座模型的宣发上不敢把话彻底说满。         目前来看,“可能”这个限定词加的还是比较艺术,也比较合理。         因为第一波社区实测下来的结论,多数都认为qwen3.8目前的表现不如抢先发布的 k3。所以如果当初中文宣发没加这个“可能”,估计现在网上的嘲讽声已经大到难以想象。

C |          但官方也强调qwen3.8正在以天为单位持续进化,意思就是后训练还没做完。         众所周知,我们还远不知道后训练的潜力有多大,参考腾讯hy3正式版相较于preview版本的提升幅度,不排除qwen3.8正式版也拿到类似剧本,完成翻盘逆袭。         而且话说回来,哪怕qwen3.8第一时间在体验上没能盖过k3,阿里也是赚的。         阿里持有月之暗面超过30%的股权,而且训练K3的算力也主要来自阿里云。所以怎么看阿里这波都不亏:你用K3,阿里云赚算力租用费,股权跟着升值;你用Qwen,阿里占住自己的开源和云生态位。         这种左右逢源的资本与算力布局,是其他单打独斗的创业公司羡慕不来的。         算力和基础设施上的要素优势,也直接反映在了商业化定价的底气上。         Kimi昨天刚刚宣布因为算力紧张不得不暂停会员开放。这就把大模型竞争最残酷的一面展现出来了。模型本身就是成本跟智能的权衡。缺乏底座云基础设施的独角兽,在突发的流量暴涨面前瞬间捉襟见肘。         而阿里这边,qwen3.8虽然能力有限,但速度快还便宜,在Kimi捉襟见肘之时,那边qwen3.8反而在搞限时一折,甚至推出了类似于传统电力系统峰谷电价的夜间折上折。

D |          但问题是,既然明知很多训练工作没做完,后训练还在以天为单位持续进化,阿里为什么还是选择在这个节点把qwen3.8抢先推出来?          已经发布的k3和即将发布的deepseek v4正式版,肯定是关键影响因素。

E | qwen3.8如果再拖下去,面临的不确定性实在太大了。         阿里内部对自己模型的真实水平肯定是有个比较清楚评估的。毕竟现在管理层也不是傻福,在行业内刷榜已成公开惯例的情况下,不至于像当初小扎发布LLaMA4 那样被团队拿出的版单数据完全蒙蔽。

F |          k3发布过后,阿里上手一测,估计也发现自己的qwen3.8在绝对能力上并没有占到便宜。

G |          而另一头,deepseek又是出了名的价格屠夫,梁圣盛名在外,其极致的工程优化和极低的推理成本是所有人头顶的悬剑。         这就构成了一个特殊的时间窗口。         如果阿里按部就班,非要等qwen3.8彻底训练完,排在deepseek v4发布后再发,那场面就会变得被动。         哪怕v4正式版的模型能力一般,但只要deepseek保持一贯的降本路线,把价格打到骨折,到时候阿里就是两头不占:论模型绝对能力,你打不过已经占领口碑高地的k3;论成本性价比,你又打不过deepseek v4。         即便qwen3.8综合来看是个很不错的模型,但一旦落入“能力比不过、价格也比不过”的两头不占境地,宣发上就会完全找不到卖点,面临极其尴尬的局面。

H |                    qwen超大杯回归开源,林俊旸“白走”了          前段时间林俊旸从阿里离职,引发了整个大模型圈的巨大震动。

I | 关于他离职的原因,圈内传闻很多,其中一点是阿里内部在开源和闭源路线上的严重分歧与路线斗争。

J |          林俊旸代表的,是Qwen团队早期技术理想主义。(也可能有给自己刷成就的考虑)在他的带领下,Qwen靠着无保留的开源一路高歌猛进,在全球开发者社区打下了极高的声誉。         但这种大慈善家式的纯粹开源,随着模型参数飙升到千亿、万亿级别,必然会撞上集团财务账本这面墙。训练一次顶级大模型需要砸入天文数字的算力和资金,集团高层不可能不去算ROI。         《晚点》报道提到,qwen max阿里是不想开源的,但林俊旸也想推动开源。

K |          开源社区的口碑有好处,但看不见摸不着。         在一部分集团高层看来,把最顶级的旗舰模型毫无保留地开源,不仅不能直接带来 API 收入,反而相当于自己花真金白银造武器,送给全行业甚至竞品用,让别人拿去抢阿里云的客户。         林俊旸走后的一段时间里,阿里大模型的路线发生了非常明显的收缩与转向。         旗舰模型开源步伐刹车,转而采取“中小模型开源,大模型闭源”的功利打法。

L |          而阿里迟迟不肯开源最大尺寸的旗舰模型,也一度被外界视为阿里逐步向闭源商业化妥协、开源理想主义退潮的信号。         比如,qwen3.6发布页面就提到,“我们还将开源更小规模的模型版本,以此重申我们对技术普惠与社区驱动创新的坚定承诺”。         这次qwen3.8发布,阿里为什么又明确宣布将开源2.4T参数的Max顶级版本呢?从收紧到重新彻底放开,这背后的逻辑转变其实并不难理解,是一次回归常识的纠偏。

M |          说白了,大模型圈子现在情况真的就是:你不开源,有的是人开。

N |          在这个阶段,开源的本质其实是用生态和声誉,来弥补模型绝对能力上的差距。         试想一下,如果你的模型能力真的跟OpenAI或 Anthropic有来有回、交替领先,那即便不开源,大家为了最好的效果,也会排着队来买单使用你的闭源 API。

o |          但现在开源模型还是跟闭源模型有差距,起码从来没有超过同期最顶尖的闭源模型。         在未来,如果有一天智谱、月之暗面这样的独立大模型厂商,真的赶上OpenAI或 Anthropic,我觉得他们大概率还是会走向闭源。         因为不这样的话,抛开AGI不谈,独立厂商的可持续性就很难解决,总不能真把投资人当成客户用吧。         阿里的情况不一样。我其实一直不太理解,之前阿里内部为什么会产生“转向闭源更划算”的这种想法。         因为作为一家掌握资源优势的云厂商,又是自家练出来的基座模型,开源对阿里来说,几乎没有损失多少实质性的利益。         就算阿里把满血权重开源出去了,别人拿去自己部署,或者中小云厂商拿去提供服务,他们在推理效率和单Token成本上,照理也不太可能达到阿里云原生部署的水平。         如果确实达到了,那只能证明阿里云太菜了。         所以,林俊旸当初因为路线分歧离开确实令人唏嘘,但好在阿里在经历了一段时间的摇摆后,最终还是算明白了这笔账。         Qwen3.8 Max重新许下开源承诺,回归过去三年的主路线,说明阿里作为云巨头终于想通了自己的核心叙事:          与其像独立模型厂商那样去抠闭源API的利润,不如大大方方地用开源模型交个朋友,用算力效率去赚整个 AI 时代“水电煤”的大钱。         蔡崇信上个月在巴黎说,AI的巨大价值是确定的,但这些价值最终汇集在哪个层次是不确定的。底层芯片、云计算基础设施、模型层以及应用层,这四个层面都有可能。阿里的思路是全栈式,也就是每个层面都做好布局。         这个分析放到行业视角成立,但从概率上说,从营收趋势上说,阿里自己最大的机会还是在基于MaaS的云计算生意。

Current article:http://www.tibiantasangnenti.buzz/list_tjrb4i4/5yznl6.html

Published on:12:08:03