Кодування флагманського рівня в щільній моделі 27B

Кодування флагманського рівня в щільній моделі 27B


22 квітня 2026 р. – блог із посиланнями

Qwen3.6-27B: кодування флагманського рівня в щільній моделі 27B (через) Великі претензії від Qwen щодо їхньої останньої відкритої моделі:

Qwen3.6-27B забезпечує продуктивність агентного кодування флагманського рівня, перевершуючи флагман Qwen3.5-397B-A17B з відкритим кодом попереднього покоління (397B загалом / 17B активного MoE) у всіх основних тестах кодування.

На Hugging Face Qwen3.5-397B-A17B має 807 ГБ, цей новий Qwen3.6-27B – 55,6 ГБ.

Я спробував це з квантованою версією Unsloth Qwen3.6-27B-GGUF:Q4_K_M на 16,8 ГБ і llama-server використовуючи цей рецепт benob на Hacker News, після першого встановлення llama-server використовуючи brew install llama.cpp:

llama-server \
    -hf unsloth/Qwen3.6-27B-GGUF:Q4_K_M \
    --no-mmproj \
    --fit on \
    -np 1 \
    -c 65536 \
    --cache-ram 4096 -ctxcp 2 \
    --jinja \
    --temp 0.6 \
    --top-p 0.95 \
    --top-k 20 \
    --min-p 0.0 \
    --presence-penalty 0.0 \
    --repeat-penalty 1.0 \
    --reasoning on \
    --chat-template-kwargs '{"preserve_thinking": true}'

Під час першого запуску вдалося зберегти модель ~17 ГБ ~/.cache/huggingface/hub/models--unsloth--Qwen3.6-27B-GGUF.

Ось стенограма для «Створення SVG пелікана, який їде на велосипеді». Це ан видатний результат для локальної моделі 16,8 ГБ:

Кодування флагманського рівня в щільній моделі 27B

Показники продуктивності, надані llama-server:

  • Зчитування: 20 токенів, 0,4 с, 54,32 токенів/с
  • Генерація: 4444 токенів, 2 хв 53 с, 25,57 токенів/с

Для хорошої міри, ось Створення SVG ОПОССУМА ПІВНІЧНОЇ ВІРГІНІЇ НА ЕЛЕКТРОСАКОТЕРІ (раніше запускався з GLM-5.1):

Цифрова ілюстрація в неоновому стилі Tron із зображенням сірої котячої істоти в блакитних окулярах із щитком, яка їде на світлому блакитному футуристичному мотоциклі темним міським пейзажем уночі, з довгим хвостом, що тягнеться позаду, із силуетами будівель із жовтими вікнами на задньому плані та сяючим пурпуровим місяцем праворуч.

Для цього знадобилося 6575 жетонів, 4 хвилини 25 секунд, 24,74 т/с.



Source link

Postagens Similares

  • التدوين أصبح جديًا في عام 2001 مع Warblogs والنوع المنقول

    📅 30 أكتوبر 2025 | ⏱️ ~دقيقة واحدة للقراءة بواسطة ريتشارد ماكمانوس كان عام 2001 عندما نشأ التدوين. ما بدأ كمذكرات شخصية متناثرة ومقالب للروابط أصبح فجأة شيئًا أكبر. بدأ الأشخاص في الكتابة في الوقت الفعلي عن الأحداث العالمية، باستخدام أدوات مثل RSS وMovable Type مما يمنح المدونات النظام الأساسي والزخم لتوصيل رسالتهم بسهولة. إقرأ…

  • प्रारंभिक चरण की कंपनी ऑफसाइट्स

    यह पोस्ट ज्यादातर मेरे दिमाग के ऊपर से Wispr AI द्वारा निर्देशित की गई थी एक दूरस्थ कंपनी चलाने के लिए आगे बढ़ते समय मैंने अपने लिए एक बुनियादी नियम बनाया कि हम कार्यालय किराये पर खर्च किए गए पैसे को तिमाही में कम से कम एक से तीन बार व्यक्तिगत रूप से मिलने के…

  • 专利承诺

    2011年8月 我最近意识到,我们也许可以解决部分专利问题,而无需等待政府。 我从来都不能百分百确定专利是否有助于或阻碍技术进步。当我还是个孩子的时候,我认为他们有帮助。我认为它们保护发明家免遭大公司窃取他们的想法。也许在过去更是如此,当时更多的东西都是物质的。但无论专利总体上是否是一件好事,似乎确实存在一些不好的使用方式。由于专利的不当使用似乎在增加,因此对专利改革的呼声越来越高。 专利改革的问题在于它必须经过政府。这往往很慢。但最近我意识到我们也可以解决下游的问题。除了在专利发布时截断专利流之外,在某些情况下,我们还可以在专利使用时截断专利流。 使用专利显然不鼓励创新的一种方式是,产品不好的老牌公司使用专利来压制产品好的小竞争对手。我们可以减少这种类型的虐待,而无需通过政府。 做到这一点的方法是让那些不采取这种伎俩的公司公开承诺不会这样做。那么那些不肯做出这样承诺的人就会非常引人注目。潜在的员工不会愿意为他们工作。投资者也将能够看到,他们是那种通过诉讼而不是通过生产优质产品来竞争的公司。 这是承诺: 不得首先针对人数少于 25 人的公司使用软件专利。 我故意用精确性换取简洁性。专利质押不具有法律约束力。这就像谷歌的“不作恶”。他们没有定义什么是邪恶,但通过公开这么说,他们表示他们愿意遵守奥驰亚所不遵循的标准。虽然“不作恶”有限制,但对谷歌来说却是件好事。科技公司通过吸引最具生产力的人才而获胜,而最具生产力的人才会被那些要求自己高于法律要求的标准的雇主所吸引。 (1) 专利承诺实际上是一个范围更窄但开源的“不作恶”。我鼓励每家科技公司都采用它。如果您想帮助解决专利问题,请鼓励您的雇主这样做。 大多数科技公司已经不会沉迷于对初创公司使用专利。你不会看到谷歌或 Facebook 起诉初创公司侵犯专利。他们不需要。所以对于技术更好的公司来说,专利质押不需要改变行为。他们只是承诺无论如何都会做他们会做的事情。当所有不会在初创企业中使用专利的公司都这么说时,抵制者将非常引人注目。 专利承诺并不能解决专利方面的所有问题。例如,它不会阻止专利流氓;他们已经是贱民了。但专利质押确实解决的问题可能比专利流氓问题更严重。专利流氓只是寄生虫。笨拙的寄生虫有时可能会杀死宿主,但这不是它的目标。而起诉初创公司专利侵权的公司通常都有明确的目标,即阻止其产品进入市场。 对初创公司使用专利的公司正在从根本上攻击创新。现在,任何个人都可以做一些事情来解决这个问题,而无需等待政府:询问公司的立场。 专利质押网站 笔记: (1)因为这个承诺故意含糊不清,所以我们在解释它时需要常识。更反之亦然:承诺是模糊的,以便人们在解释它时使用常识。 例如,我故意避免说这 25 个人是否必须是雇员,或者承包商是否也算在内。如果一家公司必须对诉讼是否违反专利承诺进行如此严格的处罚,那么这可能仍然是一个愚蠢的举动。 Source link

  • OpenAI হ্যাক একটি মিনি পেপারক্লিপ ম্যাক্সিমাইজার ছিল

    একটি জিনিস যা আমি মনে করি না যে এই OpenAI / Hugging Face ঘটনাটি নিয়ে যথেষ্ট লোক চিন্তা করছে তা হ’ল এটি বিখ্যাত পেপারক্লিপ ম্যাক্সিমাইজার দৃশ্যের একটি বাস্তব উদাহরণ যা AI সুরক্ষা ধরণের দ্বারা পছন্দ করা হয়। 📚 এটির উপর একটি সত্যিই ভাল বই হল স্টুয়ার্ট রাসেলের হিউম্যান কম্প্যাটিবল, এআই নিয়ন্ত্রণ সমস্যার উপর। এখানেই আপনি…

  • Wir stellen vor: Claude Sonnet 4.6

    Wir stellen vor: Claude Sonnet 4.6 (via) Sonnet 4.6 ist heute erhältlich und Anthropic behauptet, dass es eine ähnliche Leistung wie Opus 4.5 vom November bietet und gleichzeitig den Sonnet-Preis von 3 $/Million Input- und 15 $/Million Output-Tokens beibehält (die Opus-Modelle kosten 5 $/25 $). Hier ist das Systemkarten-PDF. Ich habe gerade llm-anthropic 0.24 mit…

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *