您好,欢迎来到 锐星AI网站导航官网 - 国内外1000+AI工具,发现好用AI,为你导航未来!
登录 / 注册 / 找回密码
全新的分类目录站点,点击去提交

“AI编程工具”网站目录

  • FAISS

    FAISS

    Faiss 是一个用于高效相似性搜索和密集向量聚类的库。它包含算法,可以在任何大小的向量集中进行搜索,直到可能不适合RAM的向量。它还包含用于评估和参数调整的支持代码。 Faiss是用C++编写的,带有完整的Python包装器。一些最有用的算法是在 GPU 上实现的。它主要由 Meta 的基础 AI 研究团队 FAIR 开发。 开源代码:https://github.com/facebookresearch/faiss

    faiss.ai - 收藏
  • Milvus 向量数据库

    Milvus 向量数据库

    Milvus 向量数据库专为向量查询与检索设计,能够为万亿级向量数据建立索引。与现有的主要用作处理结构化数据的关系型数据库不同,Milvus 在底层设计上就是为了处理由各种非结构化数据转换而来的向量而生。 Milvus是一款云原生的开源向量数据库,专为向量相似性搜索和AI应用赋能。 Milvus具有简单易用、快速高效、高可用性、高可扩展性、云原生和丰富功能等优点。 Milvus的工作原理:Milvus 2.0是一款云原生向量数据库,采用存储与计算分离的架构设计,所有组件均为无状态组件,极大地增强了系统弹性和灵活性。整个系统分为四个层面:接入层(Access Layer)、协调服务(Coordinator Service)、执行节点(Worker Node)和存储服务(Storage)。 Zilliz上的milvus介绍:https://zilliz.com.cn/what-is-milvus Milvus 向量数据库官网:https://milvus.io/

    milvus.io - 收藏
  • 混元图像3.0 多模态图像生成模型

    混元图像3.0 多模态图像生成模型

    混元图像3.0(HunyuanImage-3.0 )是一个突破性的原生多模态模型,它在自回归框架内统一了多模态理解和生成任务。它的文生图能力实现了与领先的闭源模型相当或更优的性能。 首个开源商用级原生多模态生图模型,它也是目前参数量最大的开源生图模型,参数规模高达80B。 混元图像3.0能够利用世界知识进行推理, 同时可以解析千字级别的复杂语义,生成长文本文字;图像生成效果业界领先。

    aistudio.tencent.com - 收藏
  • ChatBox AI客户端软件

    ChatBox AI客户端软件

    Chatbox AI 是一款 AI客户端应用和智能助手,支持众多先进的 AI 模型和 API,可在 Windows、MacOS、Android、iOS、Linux 和网页版上使用。 ChatBox AI客户端软件 核心功能与特色 1. 智能对话系统 多模型对比:支持同时连接 ChatGPT 4o/Claude 3.5/DeepSeek 等先进模型,自由切换体验不同 AI 风格 上下文记忆:自动保存完整对话历史,支持 Markdown/HTML/TXT 多种格式导出 个性化设置:可自定义温度、最大 token 等参数,精准控制 AI 输出 2. 生产力增强套件 文件理解:直接解析PDF/Word/Excel/图片中的内容 代码专家:提供类 Claude Artifacts 的实时代码预览能力 实时联网:一键获取最新资讯、股票行情等网络数据,回答始终与时俱进 3. 创意可视化工具 AI绘图:通过自然语言描述生成高质量图像(每月免费额度) 图表生成:支持将数据转化为可视化图表,支持 LaTeX 公式渲染 多格式渲染:完美呈现 Markdown、HTML、数学公式等专业内容 4. 企业级数据管理 本地优先:所有对话记录和文件默认存储在用户设备,保障数据主权 5.技术优势 零门槛体验:无需技术背景,安装即可享受 AI 生产力 持续进化:同步更新模型库和功能模块,保持技术前沿性 6.适用场景 学术研究:快速解析论文/教材,生成文献综述 内容创作:辅助写作、翻译、社交媒体文案生成 开发编程:代码生成/调试/文档编写全流程支持 商业分析:自动处理报表数据,生成可视化洞察 官网网址:https://chatboxai.app/ 网页版:https://web.chatboxai.app/

    chatboxai.app - 收藏
  • Qwen-Image开源文生图模型

    Qwen-Image开源文生图模型

    阿里巴巴发布了一款全新的多模态模型Qwen-Image,这款模型拥有200亿参数,专为解决“图中写字”这一难题而生。 Qwen-Image是一个200亿参数的MMDiT模型,可生成写实、动漫、赛博朋克、科幻、极简、复古、超现实、水墨等几十种类型的图片,支持图片的风格迁移、增删改、细节增强、文字编辑,人物姿态调整等常规操作。 在复杂文本渲染和精准图像编辑方面取得了显著进展。实验表明,该模型在图像生成和编辑方面均具有强大的通用能力,并且在文本渲染方面表现出色,尤其对中文文本渲染尤为出色。 Qwen-Image也可以生成OpenAI的GPT-4o爆火全网的吉卜力风格图片。根据「AIGC开放社区」实际测试二者差距很小,尤其是在超复杂中文提示词理解、文字嵌入方面Qwen-Image更好。 根据阿里公布的测试数据显示,Qwen-Image在GenEval、DPG、OneIG-Bench以及GEdit、ImgEdit和GSO测试中,图片生成、编辑能力非常出色,大幅度超越了文生图开源大黑马FLUX.1 [Dev],成为中文最好的文生图模型。

    modelscope.cn/models/Qwen/Qwen-Image - 收藏
  • Gemini-cli

    Gemini-cli

    Gemini CLI是什么 Gemini CLI是一款命令行AI工作流工具。它连接到用户的工具、理解用户的代码,并加速其工作流程。

    github.com/google-gemini/gemini-cli - 收藏
  • Jaaz-开源的AI设计Agent工具

    Jaaz-开源的AI设计Agent工具

    Jaaz是什么? Jaaz是一款功能强大的AI本地批量生图Agent工具。作为可在本地部署的工具,它具备卓越性能与高效处理能力,可充分满足用户在本地进行大规模图像生成的需求。其核心优势在于能够接入chatgpt 4o、flux – kontext等最新模型,可快速、稳定地生成大量高质量图像。 Jaaz集成了多种先进AI模型,提供All in One Canvas画布。借助全流程设计与批量出图功能,它能大幅节省设计时间,有效提升生产力。

    github.com/11cafe/jaaz - 收藏
  • SillyTavernAI角色聊天界面

    SillyTavernAI角色聊天界面

    什么是 SillyTavern? SillyTavern(或简称 ST)是一个本地安装的用户界面,允许您与文本生成 LLM、图像生成引擎和 TTS 语音模型进行交互。 一个可以本地部署的虚拟角色聊天软件,支持多种虚拟角色,也可以自己创造角色,后台可以连多种不同LLM,比如OpenAI、Claude、Llama等,支持TTS(文字转语音) 支持中文、英文、日文、韩文等多语言

    github.com/SillyTavern/SillyTavern - 收藏
  • Janus Pro 统一多模态理解与生成模型

    Janus Pro 统一多模态理解与生成模型

    Janus-Pro是什么 Janus 是由 DeepSeek 团队开发的一系列统一多模态理解与生成模型,旨在通过解耦视觉编码来实现多模态任务的高效处理。Janus-Pro 是 Janus 的升级版本,进一步优化了训练策略、扩充了训练数据集,并扩大了模型规模,从而在多模态理解和文本到图像生成能力上取得了显著提升。 Janus-Pro的功能 多模态理解:Janus 和 Janus-Pro 能够处理多种多模态任务,包括图像描述、表格和图表理解等。通过将视觉编码解耦为独立的通道,模型能够更有效地提取图像中的高维语义特征,并将其映射到语言模型的输入空间中,从而实现对复杂多模态数据的理解。 文本到图像生成:Janus 和 Janus-Pro 具备根据文本描述生成图像的能力。模型通过将文本和图像特征序列整合为统一的多模态特征序列,输入大语言模型进行处理,从而生成与文本描述相符的图像。Janus-Pro 在此方面进行了优化,引入了大量合成美学数据样本,显著提升了生成图像的稳定性和美学质量。 指令遵循与对话能力:通过监督微调,Janus 和 Janus-Pro 能够更好地遵循用户指令,并在对话场景中提供准确的回答。模型在多模态理解和生成任务中均表现出色,能够处理各种复杂的输入和任务需求。 Janus-Pro的技术原理 视觉编码解耦:Janus 和 Janus-Pro 采用独立的视觉编码路径,分别用于多模态理解和生成任务。这种解耦方式缓解了视觉编码器在理解和生成任务中的角色冲突,提高了模型的灵活性和可扩展性。例如,在多模态理解中使用 SigLIP 编码器提取高维语义特征,而在视觉生成中使用 VQ 分词器将图像转换为离散 ID 序列。 自回归框架:整个模型基于自回归框架,使用统一的 Transformer 架构进行处理。模型通过内置的预测头进行文本预测,同时引入随机初始化的预测头用于图像预测。这种设计使得模型能够在多模态任务中保持一致性和高效性。 训练策略优化:Janus-Pro 对训练策略进行了优化,包括增加第一阶段的训练步数、在第二阶段中直接使用标准文本生图数据进行训练,以及调整第三阶段监督微调过程中的数据配比。这些改进提高了模型的训练效率和整体性能。 数据扩充与模型扩展:Janus-Pro 显著扩充了训练数据集,包括多模态理解数据和视觉生成数据。同时,模型规模从 1B 参数扩展到 7B 参数,进一步提升了模型的表达能力和性能。 Janus-Pro的项目地址 Janus GitHub 仓库:https://github.com/deepseek-ai/Janus Janus-Pro 技术报告:https://github.com/deepseek-ai/Janus/blob/main/janus_pro_tech_report.pdf HuggingFace模型库: 模型(7B):https://huggingface.co/deepseek-ai/Janus-Pro-7B 模型(1B):https://huggingface.co/deepseek-ai/Janus-Pro-1B 在线体验Demo:https://huggingface.co/spaces/deepseek-ai/Janus-Pro-7B 参考链接: 腾讯云开发者社区文章:https://cloud.tencent.com/developer/article/2493369 澎湃新闻报道:https://www.thepaper.cn/newsDetail_forward_30053423 github:https://github.com/deepseek-ai/Janus

    github.com/deepseek-ai/Janus - 收藏
  • EchoMimicV2

    EchoMimicV2

    EchoMimicV2利用参考图像、音频剪辑和一系列手势来生成高质量的动画视频,确保音频内容和半身动作之间的连贯性。 项目页面:https://antgroup.github.io/ai/echomimic_v2/ GitHub 页面:https://github.com/antgroup/echomimic_v2

    github.com/antgroup/echomimic_v2 - 收藏
共 197 条12345678»

📰 推荐资讯

⭐ 推荐站点

  • 造点
    造点

    核心功能与模型 “造点”平台的最大亮点是整合了业界顶尖的AI模型,实现了“强强联合”: 1. AI生视频:率先接入 通义万相 Wan2.5 全球首发/国内首个: 成为国内首个支持音画同步生成的平台。它可以在生成视频画面的同时,自动匹配人声、音效和背景音乐。 高质量输出: 支持生成长达10秒、1080P高清、24帧/秒的视频,画质可满足专业需求。 强指令遵循: 能够理解并执行复杂的指令,如运镜、视角切换等连续变化。 声音驱动: 用户可以在提示词中用引号(“”)来描述声音,实现声音驱动画面生成。 2. AI生图:集成 Midjourney V7与夸克图片1.0 顶级美学: 接入了Midjourney V7模型。 本土化优化与易用性: 无需魔法,中文友好: 国内用户可以直接使用Midjourney V7模型,无需海外网络环境。 UI简化: 将MJ复杂的参数(如风格化、怪异化)做成了直观的滑块控制,方便调节。 辅助功能: 提供“智能润色”和“特征词库”等功能,帮助新手快速上手。 特色能力: 结合夸克自研技术,夸克图片1.0模型在亚洲人像、中文文字生成、国风元素等方面表现出色,适合电商、设计等场景。 产品体验与工作流 一站式创作流: 用户可以在平台内使用Midjourney V7生成高质量图片后,一键调用通义万相Wan2.5将图片转化为动态视频,整个创作流程非常顺畅。 双端体验: PC网页端: 提供功能最全面的专业创作体验,面向专业创作者。 夸克APP移动端: 提供轻量化的创作体验,以对话式交互为主,满足普通用户的趣味玩法和日常修图需求,如“一句话P图”、换发型、换背景、风格转换等。 价格与优惠活动 会员定价: 标准会员: 48元/月,可生成约400张MJ图片。相比Midjourney官方订阅(约70元/月生成200张),价格近乎“腰斩”。 高级会员: 188元/月,可生成约1800张MJ图片。 还有免费套餐,登录可获取每日积分。 限时免费活动: 活动时间: 即日起至9月30日。 活动内容: 所有用户均可享受7天免费体验通义万相Wan2.5的视频生成功能。 综上所述,“造点”是夸克在AIGC领域推出的一个旗舰级产品,它通过集成中外最顶尖的AI模型(通义万相2.5 + Midjourney V7),并辅以出色的本土化优化和极具竞争力的价格,为从专业创作者到普通用户的广泛人群提供了一个强大且易用的一站式AI内容创作平台。

    create.qianwen.com
  • 百小应
    百小应

    百川智能发布最新一代基座大模型Baichuan 4,并推出成立之后的首款AI助手“百小应”。Baichuan 4相较Baichuan 3 在各项能力上均有极大提升,其中通用能力提升超过10%,数学和代码能力分别提升14%和9%,在国内权威大模型评测机构SuperCLUE的评测中,模型能力国内第一。此外,Baichuan 4还具备行业领先的多模态能力,在各大评测基准上表现优异,领先Gemini Pro、Claude3-sonnet等多模态模型。在Baichuan 4强大能力的基础上,百川智能将搜索技术与大模型深度融合,推出懂搜索、会提问的AI助手“百小应”。

    yi.baichuan-ai.com
  • 腾讯元宝
    腾讯元宝

    腾讯元宝是基于腾讯混元大模型的AI助手应用,集成AI搜索、AI总结、AI写作、AI绘画等能力,同时支持创意绘画生图,帮助用户在工作、学习和生活中提高效率。

    yuanbao.tencent.com