hubio 1 345 Opublikowano 20 Lipca Opublikowano 20 Lipca @sino ale przeczytałeś cały artykuł czy tylko nagłówek? Badanie było zrobione pod tezę, że ludzie za bardzo ufają Ai... Więc pytania dotyczyły koloru strojów w filmach itp bzdury gdzie wiadomo, że Ai będzie halucynować... Sens badania nie był taki aby podważać sens Ai tylko pokazać, że ludzie bezrefleksyjnie ufają Ai. W tym celu zadano pytania z d. 99,999% ludzi nie pyta się o kolor stroju w filmie... Choć rozumiem intencje badaczy bo rzeczywiście to błąd, że Ai nie mając pewności wymyśla i powinno mówić, że nie wie i to jest akurat źle rozwiązane. Bo lepszy brak odp. niż błędna odp. Albo nawet tak jak ludzie algorytmy kiedy nie wiedzą na 100% powinny pisać: "wydaje mi się, że"... Ja obecnie oprócz wywoływania red flag jak mam zły humor wyzywam Ai od najgorszych itp i jak nawet po takim wyzwaniu potwierdza, że ma rację to ma rzeczywiście rację... Ostatnio testowałem z jednym z modów do gry co myślałem, że nie ma na steam, ale źle szukałem i Ai napisało, że na pewno jest i był... Ale jak się myli i się wyzwie to potrafi się przyznać. Choć też czasami w 2 stronę, że ma rację i przeprasza... Różnie bywa. Zawsze warto bardzo ważne informacje weryfikować, ale z grubsza (jak tu już pisałem wiele razy) w 80% przypadków, przynajmniej o co ja pytałem były dobre odp.
Pentium D Opublikowano 21 Lipca Opublikowano 21 Lipca @musichunter1x Przed chwilą widziałem te kopaniny na innym kanale i robi wrażenie. Głównie to jak szybko potrafią wstać, ale i zachowanie balansu w niektórych sekwecjach.
oldfashioned Opublikowano 21 Lipca Opublikowano 21 Lipca 6 godzin temu, hubio napisał(a): Ja obecnie oprócz wywoływania red flag jak mam zły humor wyzywam Ai od najgorszych itp i jak nawet po takim wyzwaniu potwierdza, że ma rację to ma rzeczywiście rację... Ale jak się myli i się wyzwie to potrafi się przyznać. Choć też czasami w 2 stronę, że ma rację i przeprasza... Wystarczy Dzeminaja zwyzywac od bycia glupia Dzesika, czy Clauda od bycia tepym Klaudiuszem i wtedy juz podaja poprawne zweryfikowane odpowiedzi? Kurde, ze tez nie wiedzialem ze to takie proste
JeRRyF3D Opublikowano 21 Lipca Opublikowano 21 Lipca Full AI. https://www.ppe.pl/news/419059/tworca-dystryktu-9-mierzy-sie-z-krytyka-neill-blomkamp-stworzyl-caly-film-przez-ai-jest-dostepny-na-youtube.html
Wu70 Opublikowano 21 Lipca Opublikowano 21 Lipca 7 godzin temu, hubio napisał(a): Bo lepszy brak odp. niż błędna odp. A zastanawiałeś się kiedyś dlaczego? Bo w życiu jest dokładnie odwrotnie, już od najmłodszych lat jesteś uczony że lepiej strzelić na egzaminie niż zostawić puste pole. Dokładnie ta sama geneza jest w przypadku AI, próba odpowiedzi daje większą szansę sukcesu. OpenAI jakiś dłuższy czas temu wydało art że to trudny problem do przeskoczenia.
musichunter1x Opublikowano 21 Lipca Opublikowano 21 Lipca (edytowane) Wystarczyłoby nauczyć AI polskiego - "Nie wiem, ale się domyślam." Ostatnio na szybko chciałem sprawdzić all core boost na i5 12600t to AI googla halucynowało mi w jednym oknie, nawet po zwróceniu uwagi że to procesor T, a w drugim było poprawne. Do szukania nietypowej obudowy PC, czy nawet klasycznej nie nadaje się, bo nie rozumie pozycji komponentów.... Mam większą szansę na znalezienie poprzez przypadkowe przeglądanie allegro i właśnie tak znalazłem jedną. Edytowane 21 Lipca przez musichunter1x
Wu70 Opublikowano 21 Lipca Opublikowano 21 Lipca (edytowane) Bal trwa w OpenAI, ostatnie ~1.5 tygodnia to jakieś 8 resetów tygodniowych limitów, praktycznie bez ograniczeń dostęp do topowych modeli, nawet dla darmowych kont (ale tu nie tak dużo jak w subskrypcjach). Edytowane 21 Lipca przez Wu70
nozownikzberlina Opublikowano 21 Lipca Opublikowano 21 Lipca 28 minut temu, Wu70 napisał(a): nawet dla darmowych kont (ale tu nie tak dużo jak w subskrypcjach). no na darmowym mi blokada wskakuje po kilku wiadomościach i trwa 24 godziny, a nie używałem ich kilka miesięcy chyba więc nie mam zfloodowanego konta
Wu70 Opublikowano 21 Lipca Opublikowano 21 Lipca Już Ci pisałem że ChatGPT Work i ChatGPT Codex mają oddzielne limity od zwykłego chatu. Work/Codex nawet nie mają limitu wiadomości tylko faktycznego zużycia (tokeny).
galakty Opublikowano 22 Lipca Opublikowano 22 Lipca @Wu70 mam udostępnione lokalnie GPT-5.6-Sol, GPT-5.6-Terra and GPT-5.6-Luna - coś poradzisz?
Wu70 Opublikowano 22 Lipca Opublikowano 22 Lipca Co masz na myśli? Sol będzie najlepszy, przy 5.6 dodali też nowy najwyższy reasoning effort (MAX) i tryb ultra (multi agent) a jak przez API to można jeszcze wbić reasoning mode PRO.
galakty Opublikowano 23 Lipca Opublikowano 23 Lipca 13 godzin temu, Wu70 napisał(a): Co masz na myśli? Sol będzie najlepszy, przy 5.6 dodali też nowy najwyższy reasoning effort (MAX) i tryb ultra (multi agent) a jak przez API to można jeszcze wbić reasoning mode PRO. Jak się sprawuje względem innych
sabaru128 Opublikowano 23 Lipca Opublikowano 23 Lipca W dniu 21.07.2026 o 08:27, JeRRyF3D napisał(a): Full AI. https://www.ppe.pl/news/419059/tworca-dystryktu-9-mierzy-sie-z-krytyka-neill-blomkamp-stworzyl-caly-film-przez-ai-jest-dostepny-na-youtube.html Nawet nie oglądam bo zaraz będę miał pełno tego badziewia wyświetlanego w proponowanych.
Wu70 Opublikowano 23 Lipca Opublikowano 23 Lipca 3 godziny temu, galakty napisał(a): Jak się sprawuje względem innych Ogólny konsensus bez konkretnej podkategorii: Fable 5 > GPT 5.6 Sol > Opus 4.8 >> Gemini Niższych modeli (Terra, Luna) nie używam zazwyczaj, ludzie nawet chwalą ten najmniejszy Luna. Ja raczej okazjonalnie więc nie chcę oceniać. W pracy ostatnio puszczałem Opus vs Sonnet 5 vs 5.6 Sol na kilkunastu issue równolegle każdym modelem, 5.6 Sol i Opus top, Sonnet wyraźnie gorzej. Do domowych zastosowań 5.6 Sol to obecnie TOP, przede wszystkim przez kosmiczne limity od openai w subskrypcjach. Rekordowego 15 lipca zużyłem 1.3mld tokenów, 916$ po cenach API, kosmos Mając tak gigantyczne budżety obecnie inne modele nie mają sensu.
GordonLameman Opublikowano 23 Lipca Opublikowano 23 Lipca Ja mam teraz pustkę w sercu po tym jak Fable przeszedł na usage poza subskrypcją. Świetny model do pracy - najlepszy z dotychczasowych.
Wu70 Opublikowano 23 Lipca Opublikowano 23 Lipca Absolutne TOP1, nowa klasa modeli na którą nie będzie przez jakiś czas odpowiedzi od OpenAI (GPT-6) i Google (Gemini 4). Na pocieszenie rozdali wszystkim 100$ usage Fable 5 więc trzeba przemyśleć na co wydać
GordonLameman Opublikowano 23 Lipca Opublikowano 23 Lipca 2 godziny temu, Wu70 napisał(a): Absolutne TOP1, nowa klasa modeli na którą nie będzie przez jakiś czas odpowiedzi od OpenAI (GPT-6) i Google (Gemini 4). Na pocieszenie rozdali wszystkim 100$ usage Fable 5 więc trzeba przemyśleć na co wydać Akurat mam projekt z dużą ilością dokumentów i żmudnego poprawiania to będzie akurat
Oldman Opublikowano 24 Lipca Opublikowano 24 Lipca w końcu jakas ciekawa koncepcja a nie zwykły bełkot z generatora
Wu70 Opublikowano 25 Lipca Opublikowano 25 Lipca (edytowane) Anthropic mocno odpowiada! Opus 5 https://www.anthropic.com/news/claude-opus-5 Według benchmarków to nawet lepiej niż Fable 5. Wstępnie to wygląda na bardzo podobny model do Fable, mniejszy model ale świetny progress w wynikach. Innymi słowy nowe TOP1 do domowego wykorzystania. Edytowane 25 Lipca przez Wu70
Zas Opublikowano 25 Lipca Opublikowano 25 Lipca (edytowane) Pytam właśnie AI, dlaczego plik bat, który ma mi uruchomić VS Code, a następnie skrypt AHK do zmiany rozmiaru okna VSCode (problem z zapamiętywaniem przez każdą aplikację opartą na Chrome) raz pozwala się zamknąć terminalowi, a raz nie. Fakt, AI podało mi poprawny kod (konieczność użycia zmiennej do deklaracji ścieżki i uruchomienie przez PowerShell - z tym, że to pierwszy wynik ze StackOverflow, więc akurat wiele się nie napracowało) - ale przy próbie wyjaśnienia, dlaczego terminal przy ścieżce do pliku AHK z cudzysłowem się nie zamyka, a przy ścieżce bez cudzysłowu już tak, poległo kompletnie i "szyje" jak student na egzaminie, przed którym łoił do rana podlaski samogon. No cóż, na Stacku niestety tego nie wyjaśnili, bo to jakaś skomplikowana sprawa z tym, jak naprawdę uruchamiany jest code.exe (jakieś parametry via cmd czy coś) Ech, w takich sytuacjach wyłazi w 100% jak "rozumne" jest obecne AI. Zwykła wyszukiwarka, tylko że operująca na transformowaniu całych stron i brutalnej mocy obliczeniowej (dziękujemy za ceny RAM i SSD) do statystycznego składania transformowanych elementów i szukania wzorców. Oczywiście, daje to czasem spektakularne rezultaty, z włamaniami hakerskimi włącznie , no i (hubio nadal się tym zachwyca?) ma się przy tym wrażenie rozmowy z angielskim dyplomatą, ale... OK, już łapię, do takiej wiedzy to też pewnie tylko specjalistyczne modele programistyczne trenowane na odpowiednich danych, prawda? A zysków nadal nie ma, pomimo tego, że już wszystkie korporacje przeszły na vibe coding... Edytowane 25 Lipca przez Zas
nozownikzberlina Opublikowano 25 Lipca Opublikowano 25 Lipca (edytowane) 9 godzin temu, Zas napisał(a): Ech, w takich sytuacjach wyłazi w 100% jak "rozumne" jest obecne AI. Zwykła wyszukiwarka jakiś czas temu wrzucałem tutaj jak AI brutalnie zerżnął specyficzny kod z githuba, tylko pozmieniał nazwy zmiennych. edit: one po prostu kradną rzeczy, a jak czegoś nie mogą znaleźć to walą takie głupoty, że szok Edytowane 25 Lipca przez nozownikzberlina
Amsztel Opublikowano 29 Lipca Opublikowano 29 Lipca W dniu 26.07.2026 o 00:27, nozownikzberlina napisał(a): jakiś czas temu wrzucałem tutaj jak AI brutalnie zerżnął specyficzny kod z githuba, tylko pozmieniał nazwy zmiennych. edit: one po prostu kradną rzeczy, a jak czegoś nie mogą znaleźć to walą takie głupoty, że szok Tak to dziala i jest wiadome od zawsze. Nie rozumiem skad to zdziwienie ludzi, ze tak jest.
nozownikzberlina Opublikowano 29 Lipca Opublikowano 29 Lipca Godzinę temu, Amsztel napisał(a): Tak to dziala i jest wiadome od zawsze. Nie rozumiem skad to zdziwienie ludzi, ze tak jest. nie zdziwienie, ale niektórzy po prostu wychwalają ai i nakładają narrację, że ono coś tworzy. Potem jest brutalna weryfikacja
Karister Opublikowano 29 Lipca Opublikowano 29 Lipca AI, podobnie jak wiele innych narzędzi, daje takie rezultaty, jak się go używa. Dobry setup, odpowiednio dobrany model oraz sensowne prompty potrafią zdziałać cuda.
Rekomendowane odpowiedzi
Jeśli chcesz dodać odpowiedź, zaloguj się lub zarejestruj nowe konto
Jedynie zarejestrowani użytkownicy mogą komentować zawartość tej strony.
Zarejestruj nowe konto
Załóż nowe konto. To bardzo proste!
Zarejestruj sięZaloguj się
Posiadasz już konto? Zaloguj się poniżej.
Zaloguj się