🔥NaiveAI 发布 Naive-N0.5-Flash,一个面向编程和 AI 研发的开源大模型。
规格:-309B 参数的 MoE 模型;-每个 Token 激活约 15.5B 参数;-原生支持 100 万 Token 上下文;-使用稀疏注意力,而不是完整 Attention;-模型权重和推理代码采用 MIT License;-提供 API,官方定价为输入每百万 Token 0.10 美元、输出 0.40 美元、缓存读取 0.01 美元。
主要架构:(5 层 Sliding-Window Attention + 1 层 DeepSeek Sparse Attention)SWA 只关注附近窗口,DSA 从完整历史中挑选最重要的 Token,减少百万级上下文下的计算量。DSA 每次最多选择约 2,048 个 Token,使用 4 组 KV 的 GQA 结构。
配套自研由 AI 参与开发的推理运行时,超快模式最高可达2000 tok/s。模型权重与代码今日以 MIT 协议开源开放。
核心亮点:模型研发大量由 AI 完成实验、写代码与迭代调优,人类负责目标设定、评估标准与关键决策,是 “AI 造 AI” 的典型工程案例。
🤗HuggingFace:huggingface.co/NaiveAI/Naive-N0.5-Flash💻GitHub:github.com/NaiveAI-Labs/Naive-N0.5-Flash

