今バズってるAI系オープンソースを毎日発信|海外で話題のGitHubレポジトリを最速で紹介|“使えるかどうか”まで解説|AI・開発トレンドを追う人向け|AIメディア|組織全体への「 AI導入」は下のHPからご相談ください👇

Based in Japan
Filter
Exclude
Time range
-
Minimum likes
Google フライトで「チューリッヒからロンドン」を探させたら、7.1秒で終わったブラウザ操作AIがあります😳 browser-use が無料で公開した jev-ultrafast です。 nitter.net/0x_rody/status/2102071… 速さの秘密は、仕事の分け方にあります。 ① 画面のボタンや入力欄に番号を振る ② Jev(選択肢から答えを選ぶのが得意なモデル)が、次の操作と押す場所を1回で決める ③ 文字を打つときだけ小さな言語モデルを呼ぶ ★19,890 で、使うには API キーが2つ必要です。 判断と文字入力を分けるこの発想は、自分のツールにもそのまま真似したくなりました。 これなら、フライト検索のような決まった手順の操作を、待たずに任せられます。 オープンソースはこちら👇 github.com/browser-use/jev-u…
rody
2
288
Mac に便利アプリを1本ずつ買い足してきた人へ👀 それ、メニューバーのアイコン1つにまとめられます。しかも無料です。 有料アプリ十数本ぶんの仕事を、このアイコン1つが引き受けます。 ・アプリごとの音量調整と、100%を超える音量ブースト ・CPU や温度、電池の状態が見えるシステムモニター ・画像やファイルまで残るクリップボード履歴 ・Claude と Codex の上限とリセット時刻を、画面上部に常に表示 アカウント登録も利用データの送信もなしで、★21,258 まで伸びています。Claude の上限をいちいち見に行かなくて済むのは、かなり助かります。 上限が見えるようになったら、次は消費そのものを減らす番です。 減らし方を50本、種類別に並べたのがこの下の記事です👇 オープンソースはこちら👇 github.com/vorssaint/vorssai…
2
3
872
契約書や論文の PDF を、そのまま AI に貼って読ませている人へ👀 Baidu が出した無料の文字読み取りAIを先に通すと、何ページもある文書を1回の処理でテキストに直せます。 Unlimited-OCR は、ページを1枚ずつ切り分けずに文書をまとめて読む作りです。ブラウザで試せる無料デモが Hugging Face にあるので、入れる前に自分の書類で確かめられます。 6月末には vLLM(AIを速く動かす仕組み)での実行に、7月には自分の書類での追加学習にも対応しました。★26,253、MIT です。 紙の資料が多い仕事ほど、クラウドに出さずに済むのは正直ありがたい。 文字にしたあとの渡し方まで整えると、もっと楽になります。 PDF 以外の Word や Excel を AI 向けに直す方法は、この下の記事で MarkItDown を使って解説しています👇 オープンソースはこちら👇 github.com/baidu/Unlimited-O…
3
802
Photoshop は6,455MB、こっちは12MB。 それでもレイヤーとマスク、写真の要らない物を消す道具までそろった Mac の画像編集アプリが無料で出ています😳 nitter.net/robbietilton/status/21… 6,455MB は作者の Mac の Photoshop の実測です。 ・レイヤー、マスク、描画モードは Photoshop と同じ並び ・要らない物を塗って消すブラシと、周りになじむ塗りつぶし ・PSD もフォルダやマスクを残したまま開ける ・ショートカットも Photoshop と同じ Adobe の月額をやめたくて作者が自作したアプリで、★5,423。brew の1行で入ります。 ショートカットがそのまま使えるのは、乗り換える側にはありがたい。合成のためだけに毎月払ってきた人ほど、浮くお金は大きい。 オープンソースはこちら👇 github.com/robbietilton/Comp…
Robbie Tilton
5
930
ロジクールのマウス設定アプリ Options+ の代わりになる無料ソフトが★21,706まで伸びています😳 アカウント登録も、外部への送信もありません。 何ができるかというと👇 ・ボタンの割り当てを短押しと長押しで別々に決められる(押しっぱなしで通話オンにする設定も可) ・設定はテキスト1枚。別のPCへ写すだけで同じ操作環境が再現する ・Bolt・Unifying・Bluetooth・有線のどれでも、電池残量と充電中かどうかが出る ・Windows と macOS に加えて Linux が正式対応 ❌ 重い純正アプリを入れて、アカウントまで作らされる ⭕ 軽い1本を置いて、設定ファイルを自分の手元に持つ まだ開発中で安定版ではない点だけ注意。それでも純正に戻る理由が見つからないので、しばらくこれで運用してみます。 オープンソースはこちら👇 github.com/AprilNEA/OpenLogi
5
724
【速報】 Qwen-Image-2.1 なら、2Kの絵を出してから「ここだけ直して」まで同じ1本で終わります。 画像の道具を増やし続けてきた人は、もうこれ一択かもしれません。 nitter.net/ComfyUI/status/2101662… ComfyUI に入れるだけで、生成用と編集用を行き来する手間が消えます。 できるのはこの3つ👇 2Kで 最初から描ける 参照画像を10枚まとめて 1回で直せる 背景を抜いても 出せる これまでは、 作る用のモデルを入れて 直す用のモデルも入れて 毎回どっちか決めて 行き来させる という手数が要った。 でもこれからは、 7Bの1ファイルを置く ↓ 作るも直すも同じ場所 ↓ 切り替えが消える 重みは公開で 課金もなし。 実は入ったのは9月20日。 まだ触っている人は ほとんどいない。 つまり、 画像まわりの作業は ここから1本道。 先に触った人が得します。 オープンソースはこちら👇 github.com/QwenLM/Qwen-Image…
ComfyUI
3
1,131
グラフィックボードのメモリが足りず、大きいAIを諦めた人へ👀 colibri を入れると、7,440億パラメータという最大級のモデルが手元のPCで動き出します。 使うメモリは9.9GB、起動は32秒です。 ・保存ドライブ・メインメモリ・映像用メモリの3つを、1つの置き場としてまとめて扱う ・GLM-5.2やKimi K3(2.8兆)など9系統がそのまま動く ・依存ライブラリゼロの純C。コマンド1つで対話・サーバー・ブラウザ画面を切り替えられる 要は、モデルの大きさを理由に機材を買い足す前提が崩れたということです。★36,526、Apache-2.0。 買い替えを待たずに、今ある1台で試していけます。 手元のAIを無料まで持っていく道筋は、この記事に一本でまとまっています。 全体像を先に入れておくと迷いません👇 オープンソースはこちら👇 github.com/JustVugg/colibri
1
9
1,585
【衝撃】 Expo公式の skills を置くと、AIが出すiPhoneアプリの画面が急にプロの見た目になります。 React Native で作るなら、もうこれ一択です。 nitter.net/jaimintf/status/210101… 指示書5本を無料で配っています。 中身はこの4つ👇 ・best practices → 作りの型 ・app design → 画面の作法 ・animations → 動きの付け方 ・performance → 重さ対策 つまり Claude Codeや Cursorに 読ませておくだけで 出てくる画面が変わる。 これまでは 人間 ↓ 細かく指示 ↓ AI ↓ それっぽい画面 ↓ 直しは自分 今は 公式の指示書 ↓ AI ↓ 作法を踏んだ画面 ↓ 直しがほぼ要らない ★2,587、MIT。 入れるのはフォルダごと。 全部無料。 見た目でつまずく人に 効きます。 次の1画面から、 直しが減ります。 オープンソースはこちら👇 github.com/expo/skills
jaimin
1
10
1,173
自分の投稿がなぜ伸びないのか分からない人へ👀 X本体が、おすすめ欄の並び順を決めているコードをまるごと公開しています。 中の人に聞かなくても、仕組みを自分で読めるようになりました。 何が読めるかというと👇 ・おすすめ欄はフォロー中とフォロー外を混ぜ、AIが並べ替えている ・いいねや通報の重みは、生の件数ではなく自分の行動から予測した確率にかかる ・だから「通報1件でいいね468件が消える」という有名な話は誤り、と公式が名指しで否定した ・9月18日の更新で、法令対応で投稿が伏せられた国まで報告に出るようになった ★33,291、Apache-2.0で商用も可。 伸びない理由を運のせいにしていた側なので、これを読める状態は正直ありがたいです。 オープンソースはこちら👇 github.com/xai-org/x-algorit…
3
684
★4万超えの定番OSS 8選。全部そのまま自分のサーバーで動かせます。 1. uptime-kuma サイトやAPIの死活監視を、自分のサーバーで動かせる監視ツール。★9.1万 github.com/louislam/uptime-k… 2. lazygit gitの操作をターミナル画面から目で見て進められるUI。★8.2万 github.com/jesseduffield/laz… 3. memos Markdownで即メモ、データは自分の手元に置ける軽量メモツール。★6.3万 github.com/usememos/memos 4. gitea Gitホスティングとレビュー、パッケージ、CI/CDまで一式を自前運用。★5.8万 github.com/go-gitea/gitea 5. nanobot WebUI・記憶・MCPまで入った軽量の自前AIエージェント基盤。★4.8万 github.com/HKUDS/nanobot 6. bubbletea ターミナルで動く画面を作るためのGo製フレームワーク。★4.4万 github.com/charmbracelet/bub… 7. headscale Tailscaleの管理サーバーを自分で立てるためのOSS実装。★4.3万 github.com/juanfont/headscal… 8. puter ブラウザの中で動くデスクトップ環境を丸ごと自前で持てる。★4.3万 github.com/HeyPuter/puter どれも無料で、今日そのまま立てられます。 必要になる日が必ず来るので、ブックマーク推奨です。
1
4
44
5,038
ネットが無い場所で知識を引くなら、これ一択かもしれません。 Crosstalk SolutionsのProject NOMADは、オフラインのWikipediaと講座、地図、ローカルAIを1台にまとめられます。★3.7万。 ・Kiwixでウィキペディアや医療資料、Kolibriで講座を配信 ・Ollamaを足せば、資料を読ませたAIチャットもネット無しで動く ・導入はコマンド1本、あとはブラウザの8080番から設定できる 最小構成はメモリ4GBから。回線断を前提に組む発想が面白いです。 オープンソースはこちら👇 github.com/Crosstalk-Solutio…
1
6
875
【有料級プレゼント6個:無料配布👀🎁】 この度、オープンソース研究所で発信してきた「有料SaaSに払い続けず、無料OSSで自分の仕事を回す」ノウハウを、有料級プレゼント6個にまとめて、期間限定で完全無料配布することにしました🔥 ◤ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄ ̄◥  オープンソース研究所:  無料OSSで組む  自分専用の仕事環境  有料級プレゼント(全6個) ◣________________◢ ※プレゼントの受け取り方法は【投稿の最後】にまとめています👇 ですが、受け取るかどうかは、この下を読んでからで大丈夫です。 まず結論から、今回無料配布するこの6個はマジでやばいです。。。。 なぜかと言うと「無料OSSを試し始めた人の9割が、必ず詰まるポイント」を、そのまま教材構成に落とし込んでいるから。しかも扱っている内容は、エンジニア経験がない人向けです。毎月のツール代を減らしたい人大歓迎💪 ・毎月いろんなサービスに、気づけばそれなりの額を払っている ・クラウドのAIは便利だけど、機密データを外に上げるのは正直こわい ・無料で使えるOSS(オープンソースのソフト)があるのは知っているけど、どれを選べばいいか分からない ・AIを自分のPCの中だけで動かしたいけど、やり方が分からない そんな状態からでも進められるように、 「そもそもそれは何か?」という概念レベルから説明しています。 ▼ 6個の中身 ①無料OSS × ローカルAI 業務自動化スターター  → 有料SaaSを無料OSSに置き換える全体マップと、何から入れるかの導入順 ②ローカルAI構築の教科書(Ollama / RAG / MCP)  → 機密を外に出さず、自分のPCの中だけでAIを動かす手順。設定ファイルのZip付き ③オープンソース・ナレッジ倉庫テンプレ(Zip)  → git × Markdown × 全文検索で、散らかった資料を「腐らないナレッジ倉庫」にするテンプレ一式 ④OSSツール選定ワークブック(Excel)  → 「今使っている有料ツール → 代わりになる無料OSS」をツール単位で選べる置き換え表 ⑤OSS × AI プロンプト集(ローカルLLM / 自動化用)  → ローカルAIに実際に仕事をさせるための、そのまま使えるプロンプト ⑥セルフホスト運用キット(cron / 監視 / 同期 / バックアップ)  → 一度組んだ環境が、止まらない・壊れない・消えないための運用セット この6個で、  「有料SaaSを無料OSSに置き換える」→「ローカルAIを自分のPCで動かす」→「止まらないように運用する」 までを、順番通りに体系化しています。 さらにこの教材は、自分自身が「毎月サブスクに払い続けて、これ本当に全部いる?とモヤモヤしていた状態」から ・どこで詰まり ・何が分からず ・どうやって乗り越えたのか その全プロセスを実体験ベースで作成しています。 当時の自分は、どのツールをどのOSSに置き換えられるのかが分かりませんでした。機密データをクラウドに上げずにAIを使う方法も分からない。やっと組めても、すぐ動かなくなる。その繰り返しで何度も詰まりました。 だからこの教材は、「できる人向け」ではありません。「分からない人の目線」を前提に作られています。 さらに今回の目玉として、①の「業務自動化スターター」に、置き換えの全体マップと導入順を丸ごと入れています🎁 ・今払っている有料SaaSが、どの無料OSSに置き換わるかの全体マップ  → 「自分の場合はどれ?」が一覧で分かる ・「まず何を入れて、次に何を繋ぐか」の導入順  → 迷わないための順番が最初から決まっている ・最小構成から、自分専用の仕事環境を育てる進め方  → いきなり全部やらない。1つずつ足していける 正直、「このスターターだけでも、普通に有料級」と言われる内容だと思います🔥 そして今回、このプレゼントを受け取っていただいた方限定で、今後も以下のような取り組みを継続していきます👇 ① 海外で話題になっている無料のAI系OSSを、いち早く紹介 ② そのOSSが  「結局、実務で使えるのかどうか」まで踏み込んだ解説 ③ 有料SaaSを無料OSSに置き換えた実例と、詰まりどころの共有 ④ ローカルAI(自分のPCの中だけでAIを動かす)まわりの新しい情報 ⑤ 「見て終わり」にしない、業務へ組み込むための最小手順の発信 では、なぜこんな企画をしているのか❓ 正直に言うと、自分はXを見ていてずっと感じていました。 「便利な無料OSSは、毎日のように出ている」 「でも、どれを、どの順で、自分の仕事にどう組み込めばいいのか分からない」 この状態で止まっている人が、あまりにも多いと。実際に多い詰まりは、毎回ほぼ同じです。 ・良さそうなOSSは見つかるけど、選びきれない ・クラウドに機密を出せなくて、AI活用を諦めている ・ローカルで動かそうとして、環境構築でつまずく ・一度組んでも、いつの間にか動かなくなって放置 だから今回、  「見て終わり」だった無料OSSを、自分の仕事を回す土台として実際に動かせるようになるまで その全プロセスを、6個の有料級プレゼントとしてまとめ、期間限定で無料公開することにしました。 正直、この内容は他であれば有料で販売されていても全くおかしくありません。 ですが、自分も最初は「何をやればいいか分からない状態」で、かなり悩みました。同じように悩んでいる人は、今も必ずいるはずだと思い、今回思い切って無料配布することにしました。 ─────────────── ▼ プレゼントの受け取り方法 ▼ ① この投稿を『いいね&リツイート』 ② こちらから受け取りページへ→plai-ai.co.jp/go/oss6-x-post ─────────────── 正直、ここまでのボリュームを無料で出すのは、かなりやばいです。それでも自分は、本気で「有料SaaSに縛られず、無料OSS × ローカルAIで仕事を回せる人」を増やしたいと思っています。 もし少しでも「いいな」「価値がある」と感じていただけたら、引用リツイートでの拡散にご協力いただけると嬉しいです。 本気で無料OSS × ローカルAIをやりたい人に、この6個が届いてほしい。そして、オープンソース研究所は未来永劫有益な発信を続けていきます。今後とも何卒よろしくお願いいたします🙇
1
3
7
1,260
動画のナレーション録りで、毎回撮り直しに時間が溶ける人へ👀 OpenBMBのVoxCPM2は、テキストを渡すだけで30言語の音声を作れます。参照音声が無くても「落ち着いた低めの男性、ゆっくりめ」みたいな説明文から声を設計できる。 ・短い参照音声があれば、声色そのままで感情や速さだけ動かせる ・出力は48kHzのスタジオ品質で、後から上げ直す処理が要らない ・重みもコードもApache-2.0なので、商用の案件にそのまま使える RTX 4090でRTF約0.3、★3.7万。自分の声を1本作っておくと、撮り直しの往復が消えます。 オープンソースはこちら👇 github.com/OpenBMB/VoxCPM
14
1,309
画面録画の本命が、無料のまま大型更新です。 Loom代替のOSS「Cap」がv0.6を公開しました😳 nitter.net/cap/status/20998889558… 録りながらアップロードが走るInstant Modeなら、録画を止めた瞬間にもう共有リンクが出ています。バグ報告や進捗の共有みたいに速さだけが価値になる場面は、これで足ります。じっくり見せたいときはStudio Modeで、背景もズームもトリミングも字幕も手元で仕上げてから出せる。 つまり 撮り方ではなく、録画データをどこに置くかで選ぶ道具になったということ。保存先はCap Cloudのほか、S3・Cloudflare R2・Backblaze B2・MinIO・Wasabiから選べて、Docker Composeで丸ごと自前のサーバーにも載せられます。 今回の目玉はエディタの作り直しと3Dシーン、Studio Sound、カメラの切り抜き。作者本人が「これまでで最大のリリース」と書いていました。macOSとWindowsの両方にデスクトップアプリがあり、★2.2万。 録画を他社のクラウドに預けたくない人ほど、ここが効くと思います。 オープンソースはこちら👇 github.com/CapSoftware/Cap
Cap
2
864
【公式】Tencentが、社内資料の検索AIを公開しました。 WeKnoraにPDFや議事録を放り込むと、検索できるRAGと、勝手に育つWikiに変わります。★2.6万。 ・生の文書から相互リンク付きのWikiを自動生成、版の差分と巻き戻し付き ・PDF・Word・Excel・画像・XMindなど10以上の形式をそのまま取り込む ・LLMは20社以上から選べて、丸ごと自前のサーバーで動かせる 資料が「置いてあるだけ」の状態から抜け出せます。 オープンソースはこちら👇 github.com/Tencent/WeKnora
1
10
1,400
【速報】 写真1枚と音声で、話す動画が作れます。 中国の美団が公開したLongCat-Video-Avatarが、いま無料で触れます😳 nitter.net/sauda_coder/status/209… ・写真と音声を渡すだけで、口の動きが合った人物動画になる ・数分の長さでも色ずれや画質の落ち込みが出にくい ・アニメや動物みたいな絵柄、複数人ぶんの音声にも通る ・ライセンスはMITなので、商用で使ってもそのまま つまり カメラもスタジオも編集ソフトも用意しないまま、話す動画がリポひとつで完結するということ。 土台のLongCat-Videoは13.6Bパラメータの動画生成モデルで、★8,256。 720p・30fpsの生成を数分で回す設計です。 v1.5では口の同期をWhisper-Largeに差し替えて精度を上げ、推論も8ステップまで削っています。 ここまで無料で置いていくのかと、正直びびりました。 動画生成モデルを自分のGPUで回す話は、この下の記事を読むと理解が一気に深まる。マジでおすすめ👇 オープンソースはこちら👇 github.com/meituan-longcat/L…
sauda moni
5
1,466
【殿堂】 ★9万超えまで来た定番OSSを8選。 先頭のponytailは★13.8万まで来ていて、それでも1日1,400以上のペースでスターが増え続けてます。 1. ponytail → AIに「部屋で一番の面倒くさがりなベテラン」の考え方をさせる。書かずに済んだコードが最善という発想 github.com/DietrichGebert/po… 2. supabase → 専用のPostgresが1つ付いてくる開発基盤。Web・アプリ・AIの置き場をまとめて用意できる github.com/supabase/supabase 3. gemini-cli【公式】 → Geminiの力をターミナルへそのまま持ち込むオープンソースのAIエージェント github.com/google-gemini/gem… 4. caveman → 原始人みたいな話し方に切り替えて、トークンを65%削るClaude Code用のスキル github.com/JuliusBrussee/cav… 5. pi → LLM APIの統一・エージェントのループ・画面表示・コーディングCLIが一式で揃う道具箱 github.com/earendil-works/pi 6. LLMs-from-scratch → ChatGPTのようなLLMを、PyTorchでゼロから一歩ずつ実装していく教材 github.com/rasbt/LLMs-from-s… 7. open-design → 手元で動くデザイン用アプリ。コーディングエージェントが試作画面やLPを描く側に回る github.com/nexu-io/open-desi… 8. awesome-mcp-servers → MCPサーバーを集めたカタログ。AIに繋ぐ道具をここから探せる github.com/punkpeye/awesome-… 定番と呼ばれた後も、8本合わせて1日3,500以上スターが増えてます。 名前は見たことあるけど入れてない、が一番もったいないので、ブックマークして上から順に潰してください。
1
36
3,797
【公式】 Anthropicが金融の仕事を10体のAIごと公開😳 anthropics/financial-services。 何が入っているかというと、こう。 ・銘柄比較やDCF、LBO、3表をExcelの上で直接組み立てるモデル作成係 ・決算の説明と提出書類からモデルを更新して、レポート草案まで出す係 ・帳簿のズレを見つけて原因まで辿り、承認へ回す係 ・口座開設の書類を読んで、規則に照らして不足を指摘する係 つまり、配られているのは道具ではなく「職種ごとに仕上がった担当者」です。 → 外部データの差し込み口は11本。S&P GlobalやMorningstarに直接つながります。 → 入れ方も2通り。プラグインとして入れるか、APIから動かすか。 ライセンスはApache-2.0で、★3.4万。 断り書きも正直で、出力は必ず人が承認する前提と明記されてます。 専門の担当者に割る設計そのものは、この下の記事が一番わかりやすいです。マジでおすすめ👇 オープンソースはこちら👇 github.com/anthropics/financ…
6
1,575
端末どうしのファイル受け渡しは、もうこれ一択かもしれません。 localsend/localsend、★9.1万。 ・同じネットにいる端末を見つけて、そのまま送り合える ・Windows・Mac・Linux・Android・iOSが全部同じ輪に入る ・やり取りは家や社内のネットの中だけ。外のサーバーを経由しない ・通信の鍵は端末側でその都度作って暗号化する AirDropが使えない相手に渡すたび、圧縮してアップして共有リンクを送っていた手間がまるごと消えます。 オープンソースはこちら👇 github.com/localsend/localse…
10
100
7,802