OpenAI开源模型详细性能介绍:可在本地电脑等各种环境中运行 性能媲美o4-mini

OpenAI发布了两个开源模型:gpt-oss-120b和gpt-oss-20b,这是自2019年GPT-2发布以来首次推出开源语言模型,标志着其在开源AI领域的重大进展。 这些模型专为处理复杂任务而设计,允许开发者根据需要进行调整与优化。提供高度的定制化功能,适用于各种用例,并且可以在本地电脑

2025-08-06 08:00 · opensource · goodinfo.net

阿里巴巴推出全新图像生成模型:Qwen-Image 可以精准渲染中英文文字

阿里巴巴推出 一个超强图像生成AI模型:Qwen-Image ,200亿参数(20B),可以: - 生成图像 - 精细修改图像 - 最关键的是:它可以在图像中自然地渲染文字(中英文都行) 🧠 它厉害在哪? 🖋️ 1. 超强“图中文字”生成能力(尤其是中文) Qwe

2025-08-05 08:00 · opensource · goodinfo.net

FLUX.1 Krea [dev]:一个“有主见”、“有自己审美”的图像模型 解决AI图像和“过度饱和”和“AI 味”问题

Black Forest Labs(BFL)与 Krea AI 联合发布了最新的开源权重文本生成图像模型 —— FLUX.1 Krea [dev]。 该模型突破了传统 AI 图像模型中常见的“过度饱和”和“AI 味”问题,以更加真实、独特的视觉风格生成图像,被称为“有主见”的模型。 优势:

2025-08-01 08:00 · opensource · goodinfo.net

Google开源了一款专为程序员打造的字体:Google Sans Code 采用等宽设计 将几何精准度与书法风格完美融合

Google Sans Code 是由 Google 与 Universal Thirst 字体设计团队合作开发的一款 等宽字体(Monospaced Font),它采用等宽设计,将几何精准度与书法风格完美融合,即使在极小的代码编辑器中也清晰易读,告别眯眼… 专门为 编程、技术产品和开发者界面设

2025-08-01 08:00 · opensource · goodinfo.net

Lightricks发布开源AI视频生成模型:LTX-Video 13B 比同类模型快30倍 可在消费级GPU上运行

Lightricks发布开源AI视频生成模型:LTX-Video 13B。LTXV-13B采用创新的多尺度渲染方法,先以低分辨率生成视频的粗略运动和布局,再逐步细化细节。 这种分层处理显著提升了生成速度(比同类模型快30倍),同时保持高质量输出,减少内存需求。 核心特性: - 13

2025-07-17 08:00 · opensource · goodinfo.net

Google 开源GenAI Processors 可像搭积木一样轻松开发出复杂的 AI 应用

在构建基于大型语言模型(如 Gemini)的 AI 应用时,开发者通常面临以下难题: - 多模态输入(语音、图像、文本)流程复杂 - 需要组合多个异步 API 调用 - 数据处理逻辑零散、维护成本高 - 实时响应(如语音助手)性能难以保障 Google 发布了开源 Py

2025-07-11 08:00 · opensource · goodinfo.net

GPT-4o 对视觉理解有多深?在标准计算机视觉任务上评估多模态基础模型

像GPT-4o、Gemini、Claude这些模型,不光能聊天,还能“看图说话”。但是研究人员发现: 虽然它们能看图写文字,但并不清楚它们是否真的“理解”图像,比如: - 它能区分图像里不同的物体吗? - 它能知道哪个东西远哪个东西近吗? - 它能把一个图像“拆解”成不同的部分吗?

2025-07-09 08:00 · opensource · goodinfo.net

Bitchat:一个不需要联网、无需账号、无需服务器的蓝牙私密聊天 App

Bitchat 是一个完全脱离互联网、基于 蓝牙 Mesh 网络 的点对点加密通信应用,支持 iOS 与 macOS,专注隐私、安全与离线通信体验。 你打开 App,就能自动连接附近人,不论有没有信号都能发消息。还支持加频道、私聊、屏蔽人等功能。 - 所有消息都经过端到端加密 - 不

2025-07-08 08:00 · opensource · goodinfo.net

Black Forest Labs 宣布开源对标GPT 4o 的 FLUX.1 Kontext [dev]图像模型

Black Forest Labs 发布了 FLUX.1 Kontext [dev],这是其图像编辑模型 FLUX.1 Kontext [pro] 的开源开发版本,拥有 12B参数,具备 接近专有工具的图像编辑能力,并可在消费级硬件上运行。 其目标是提供一个性能接近闭源专有模型的免费工具。 -

2025-06-26 08:00 · opensource · goodinfo.net

Google 正式推出新一代开源轻量级多模态大模型:Gemma 3n 是目前最先进的移动端和边缘设备模型

Google 正式推出的 新一代开源轻量级多模态大模型:Gemma 3n,专为**端侧部署(on-device)**而优化。 它支持图像、音频、视频和文本输入输出,致力于在移动设备上实现接近云端模型的能力。 设计目标是: > 高性能、多模态、轻量部署、可自定义、全设备适配。 它是

2025-06-26 08:00 · opensource · goodinfo.net